Pith. sign in

Paper Citation Record · LEDGER

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers

As of 9 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2509.06956.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2509.06956 v1

Coverage vector

measured 67 of 67 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-04T22:55:44.549338Z

measured 67 of 67 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

67 of 67 outbound references displayed

  • verified exact0
  • verified fuzzy62
  • unresolved5
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b4f4d5f3-c125-4fda-a2e7-65ff9d47bd29 · outbound

This paper cites Enhanced skeleton visualization for view invariant human action recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Enhanced skeleton visualization for view invariant human action recognition,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.604268Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.276189Z digest=sha256:2011c4dac3e5a21c4b79d6b3eab53bb917ace15c24e779477abb6831f51e442a

Observation 720d6735-2dbd-4c84-947c-cebf3ee3a7b3 · outbound

This paper cites BlockGCN: Redefine topology awareness for skeleton-based action recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers BlockGCN: Redefine topology awareness for skeleton-based action recognition,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.589126Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.281251Z digest=sha256:fc4d0de9fc9df7ebe61fed57a898e6619876404cd906b5523b49ac5d7ea04fc6

Observation b76054a0-1e5d-4354-a7c1-0a8a34ac3b80 · outbound

This paper cites Multi-task deep learning for real-time 3D human pose estimation and action recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Multi-task deep learning for real-time 3D human pose estimation and action recognition,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.573629Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.286129Z digest=sha256:4360a10b53f31ded72ed6c8a14d82b7d50a79b2ec413fbdc4858acb8f830f1a1

Observation 1501b5c8-696c-4514-98be-0138146998f1 · outbound

This paper cites 3D human pose estimation in rgbd images for robotic task learning,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers 3D human pose estimation in rgbd images for robotic task learning,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.559063Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.290980Z digest=sha256:dbef8e4b1ff146f509ff48fb719857382fc53a6d3df3f4383b273e190cf3eeac

Observation 8f07dd4c-430c-45db-9ae1-5f6f35af1e45 · outbound

This paper cites Hu- man 3D pose estimation with a tilting camera for social mobile robot interaction,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Hu- man 3D pose estimation with a tilting camera for social mobile robot interaction,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.544051Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.295802Z digest=sha256:ce804c93eb6861a7d6ffeb743402297a6a29c8d436545ec59ea91b8e10c6f720

Observation 825df645-40d0-4f10-b282-fc6779caec29 · outbound

This paper cites Human-aware vision-and- language navigation: Bridging simulation to reality with dynamic human interactions,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Human-aware vision-and- language navigation: Bridging simulation to reality with dynamic human interactions,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.529550Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.300262Z digest=sha256:8db678ba299a03820b13570be193c07e304fba2e997592b5216447a4948dcea6

Observation 25e097b8-cec7-468c-9a53-1bbb547db02f · outbound

This paper cites VNect: Real-time 3D human pose estimation with a single rgb camera,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers VNect: Real-time 3D human pose estimation with a single rgb camera,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.514635Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.305185Z digest=sha256:9b5fcb8e15aec6dde1fb27f749d9584a517f47cd5d48b63852230f8561503097

Observation fbe5c82b-a7a7-443b-9246-2a5a25863618 · outbound

This paper cites MotionEditor: Editing video motion via content-aware diffusion,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MotionEditor: Editing video motion via content-aware diffusion,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.500237Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.309190Z digest=sha256:f8d8de7ecb23125f0bfeb8754abbdc7930da13f093a302cb76a83ed648402cff

Observation 63df35ca-7a6a-42e6-a570-0412419b5ef3 · outbound

This paper cites Co-evolution of pose and mesh for 3D human body estimation from video,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Co-evolution of pose and mesh for 3D human body estimation from video,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.485976Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.313157Z digest=sha256:aac339e96fad00c7d5ead509ae34ecc3c2e7ddcdc0043fdcceb5ed8af5cdf13f

Observation 40c0af29-640a-4295-84fa-0278243f7c5b · outbound

This paper cites HDFormer: High-order directed transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers HDFormer: High-order directed transformer for 3D human pose estimation,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.470917Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.317152Z digest=sha256:ed2b4f986974710673ce2795c1169e41fff65a58d48352612ead2e9cd7c6dd28

Observation 37b2ad05-7ea0-4858-bdce-394562208d5a · outbound

This paper cites PoSynDA: Multi-hypothesis pose synthesis domain adaptation for robust 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers PoSynDA: Multi-hypothesis pose synthesis domain adaptation for robust 3D human pose estimation,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.455696Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.321011Z digest=sha256:da3dae93cd189854144595d459fe732b19b3978dec11434afb8fda665342645f

Observation 6e35c363-6443-46f5-8db4-7b2d87bd0fae · outbound

This paper cites APP: Adaptive pose pooling for 3D human pose estimation from videos,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers APP: Adaptive pose pooling for 3D human pose estimation from videos,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.441146Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.325284Z digest=sha256:8b8abed065eed775fa6127d03423bf9ffea59e374ad4e5e43ef95bc11c9154f4

Observation fcd25d00-440f-4a28-baf4-a4514bc50b67 · outbound

This paper cites 3D human pose estimation with spatial and temporal transformers,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers 3D human pose estimation with spatial and temporal transformers,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.426324Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.329518Z digest=sha256:b50b804bdbed137b608398f9de73129abce002d35b0a35486380b429b2ea6148

Observation 6bce40d8-d998-4d99-b04e-c62a61b716db · outbound

This paper cites MHFormer: Multi-hypothesis transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MHFormer: Multi-hypothesis transformer for 3D human pose estimation,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.411109Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.333892Z digest=sha256:e30ea1df8cc65317c05f9618e5219d1bbf8a7a92612351d9258ddb16ccc0d124

Observation b114793d-4f91-4df6-84a5-0d1836a5097f · outbound

This paper cites MixSTE: Seq2seq mixed spatio-temporal encoder for 3D human pose estimation in video,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MixSTE: Seq2seq mixed spatio-temporal encoder for 3D human pose estimation in video,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.395097Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.337864Z digest=sha256:7f92ffed1770d35bdc251bcbbcf78063cc1cbf633405725e1ee9fbde261570b9

Observation f51c0877-6a53-499d-a144-2ddfece8fcf0 · outbound

This paper cites MotionBERT: A unified perspective on learning human motion representations,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MotionBERT: A unified perspective on learning human motion representations,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.379484Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.341870Z digest=sha256:e4c0fb0c6661feaec0c7e94ddee6edb0eba3e68e160e9e26e640bec5db8b6b82

Observation 90dbc6c8-3871-4133-bec1-3be5e3cbb31e · outbound

This paper cites TCPFormer: Learning temporal correlation with implicit pose proxy for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers TCPFormer: Learning temporal correlation with implicit pose proxy for 3D human pose estimation,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.364275Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.345965Z digest=sha256:66b8315cb93091bdcb1e300f41d5da213ab62e4ce5f0f3ed8165e7da275e0b16

Observation 4b28a346-55fc-46cd-978e-798221157b3f · outbound

This paper cites P-STMO: Pre-trained spatial temporal many-to-one model for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers P-STMO: Pre-trained spatial temporal many-to-one model for 3D human pose estimation,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.347922Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.350184Z digest=sha256:6b79501ad5dd2f54ef9e6e126c4544c32ea2f90ec382d6eac6785f1db42a4300

Observation 6ed72bc7-d23f-4b68-abb8-0746094895ac · outbound

This paper cites Exploiting temporal contexts with strided transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Exploiting temporal contexts with strided transformer for 3D human pose estimation,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.332328Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.354381Z digest=sha256:4a5c89a9e749fd249d054daed1c84bfdeb53eca58641ec12f4e70079b3eadb33

Observation 72970066-8651-4f23-bb7a-435a8ef45175 · outbound

This paper cites Uplift and upsample: Efficient 3D human pose estimation with uplifting transformers,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Uplift and upsample: Efficient 3D human pose estimation with uplifting transformers,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.315890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.358309Z digest=sha256:5b02b918aa1f28217356eb9b5c58c10d513372d19af3f79ea663645877c1b016

Observation b57b8b25-c837-473a-bea7-09290c4d5b2d · outbound

This paper cites Hourglass tok- enizer for efficient transformer-based 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Hourglass tok- enizer for efficient transformer-based 3D human pose estimation,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.299990Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.362497Z digest=sha256:1401d543f429647440a68afbb98e73657aa0e4325b66ae3c61964dd03842f977

Observation f6e5953b-fcb9-4afc-abf3-0136e9c28b26 · outbound

This paper cites 3D human pose estimation in video with temporal convolutions and semi- supervised training,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers 3D human pose estimation in video with temporal convolutions and semi- supervised training,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.284393Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.366518Z digest=sha256:969a2c949a26ee6ca67ad09cd63f80c227cbdeb5b23da9a2782c268d12b84ad9

Observation 6de2d2f0-1a0c-4b75-8362-f9aa670abefe · outbound

This paper cites Attention mechanism exploits temporal contexts: Real-time 3D human pose reconstruction,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Attention mechanism exploits temporal contexts: Real-time 3D human pose reconstruction,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.267817Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.370443Z digest=sha256:d3dd0f24c0857d8dec9dc36ce425c219bc64a8c2728bee8fd92f3b2ff525af43

Observation d72560e8-4122-4bef-be79-5d62196e3970 · outbound

This paper cites Hu- man3.6M: Large scale datasets and predictive methods for 3D human sensing in natural environments,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Hu- man3.6M: Large scale datasets and predictive methods for 3D human sensing in natural environments,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.249315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.374526Z digest=sha256:68117f531e5506cc7bf198150cc4e38d1554545623d566dca013173c67853c71

Observation a5929187-bde4-4658-b9ba-79e6736a9455 · outbound

This paper cites DynamicViT: Efficient vision transformers with dynamic token sparsification,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers DynamicViT: Efficient vision transformers with dynamic token sparsification,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.232965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.378458Z digest=sha256:d5595246c100d00904521a7cdadb31e496f4678e42dd499ab7888e5afc75a132

Observation e3c76fb1-d654-40e8-8fb2-1751f3a7a9ca · outbound

This paper cites VTC-LFC: Vision transformer compression with low-frequency components,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers VTC-LFC: Vision transformer compression with low-frequency components,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.215978Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.382535Z digest=sha256:0286d8fe13c3a2e4ddd7f719c48138e0dc7b096028e8bd4fa3aada0d506a323b

Observation 97173f43-0817-4807-a09e-a6a58e64eb08 · outbound

This paper cites MotionAGFormer: Enhancing 3D human pose estimation with a transformer-gcnformer network,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MotionAGFormer: Enhancing 3D human pose estimation with a transformer-gcnformer network,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.199602Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.386402Z digest=sha256:c888b55c3c376e809ebde0c02b171dc964e9fc7979a77b68c86767626136724e

Observation b6b40d83-3956-4630-8419-7d57b536cf02 · outbound

This paper cites Attention is all you need,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Attention is all you need,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.183013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.390306Z digest=sha256:3dd743c7ba3e9510712a3a7e77ae3796388b86ce3f4849e01da8c94c00f05804

Observation cf3b16a6-684d-4883-b2c8-29b69449fdc8 · outbound

This paper cites An image is worth 16x16 words: Transformers for image recognition at scale,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers An image is worth 16x16 words: Transformers for image recognition at scale,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.394566Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.394566Z digest=sha256:e37b5c883965bf345663cd9f43a988e296bd4648a80716b609a24a03cbc1898b

Observation 5b8a6825-0064-4e7e-8788-c91ef4f6b236 · outbound

This paper cites Swin Transformer: Hierarchical vision transformer using shifted windows,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Swin Transformer: Hierarchical vision transformer using shifted windows,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.398516Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.398516Z digest=sha256:b32b570ffa63a85a4fbe43566c106cee1add85164c64461b2057e13bc49a1b0a

Observation 930f046b-5ca2-4c3c-9c0c-665dac74af64 · outbound

This paper cites GSRFormer: Grounded situation recognition transformer with alternate semantic attention refinement,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers GSRFormer: Grounded situation recognition transformer with alternate semantic attention refinement,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.144295Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.402652Z digest=sha256:4494e30790dcb432a210644936a6857db5b51df31b7f68c6a9880275fa8f556c

Observation e95de71a-0889-4338-b5aa-9c773d9e6a4e · outbound

This paper cites Implicit temporal modeling with learnable alignment for video recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Implicit temporal modeling with learnable alignment for video recognition,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.128383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.406606Z digest=sha256:53bddcd67c16512abe83a6c97b50cb49c9d15335a86b9295cb86876e5ce79cb3

Observation 1e795d72-8e81-41d3-aada-2b806054cf2e · outbound

This paper cites Adaptive multi-view and temporal fusing transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Adaptive multi-view and temporal fusing transformer for 3D human pose estimation,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.111463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.410612Z digest=sha256:4c41d00d730563f8e3d4f2232dc43fe17fcda32a9525b3186d1b274e3f2fbbf6

Observation 373eb5fd-4fe5-4259-ad24-cc80b2184597 · outbound

This paper cites SVTformer: Spatial-view- temporal transformer for multi-view 3d human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers SVTformer: Spatial-view- temporal transformer for multi-view 3d human pose estimation,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.093596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.414565Z digest=sha256:78d2888c6c09272c274aba99367a030ac9dea9d4c5c042c2d5e3375214cc6f2c

Observation 6f96e7d7-5cb6-4b93-97e5-da9dd003322d · outbound

This paper cites A simple yet effective baseline for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers A simple yet effective baseline for 3D human pose estimation,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.075721Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.418722Z digest=sha256:a34b118a16fe15af72dd3822b6f0c1e805d926c8176090aeeef54586f5a68248

Observation 14809c94-0d1a-44aa-bda2-b282dced5ba8 · outbound

This paper cites MobileHumanPose: Toward real- time 3D human pose estimation in mobile devices,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MobileHumanPose: Toward real- time 3D human pose estimation in mobile devices,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.055229Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.422985Z digest=sha256:d19337253f32de71454a3d0a818f75cd48e5f8b453978933646e62c7c77b2dfd

Observation 60ebee9c-af8f-460b-93ca-b6eeef981744 · outbound

This paper cites DeciWatch: A simple baseline for 10x efficient 2D and 3D pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers DeciWatch: A simple baseline for 10x efficient 2D and 3D pose estimation,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.032888Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.427489Z digest=sha256:595e262fa16a68bd1d36dc6c2234f961e5d64689cd9690b258b3c353e7624c58

Observation 48fab954-634f-41c6-88e5-9ca629c6d8ba · outbound

This paper cites PoseFormerV2: Exploring frequency domain for efficient and robust 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers PoseFormerV2: Exploring frequency domain for efficient and robust 3D human pose estimation,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:45.016054Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.431447Z digest=sha256:0cda4f9c900be7327bd838671de6a0a29ead2227f8e1abdaad12273dd6840f80

Observation 07385e7a-d708-4b69-a36c-50010ee4bbc9 · outbound

This paper cites MixSynthFormer: A transformer encoder-like structure with mixed synthetic self-attention for efficient human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers MixSynthFormer: A transformer encoder-like structure with mixed synthetic self-attention for efficient human pose estimation,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.991304Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.435483Z digest=sha256:b1f14e28a0591c173f0f3d426284ec84c4227a26c54450128eae9d1d4d7663a8

Observation 25bb93d7-3da1-4485-ba7d-1dd43d2da844 · outbound

This paper cites Learn- ing to reconstruct 3D human pose and shape via model-fitting in the loop,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Learn- ing to reconstruct 3D human pose and shape via model-fitting in the loop,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.975819Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.439483Z digest=sha256:f4f26cdc5d53185a7c2a0ca8433a6b26e956c4254f4929f0c51f59e38422311e

Observation 96f5d0f2-9ef8-4e5c-8065-1bd28931b230 · outbound

This paper cites Exemplar fine-tuning for 3D human model fitting towards in-the-wild 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Exemplar fine-tuning for 3D human model fitting towards in-the-wild 3D human pose estimation,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.958926Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.443509Z digest=sha256:5d9f5ac788bb035658ed68ae182e33d7a79b0d94baad28ce8bc85c46cca50157

Observation 397d71ba-eec4-45af-9869-de21c78643b3 · outbound

This paper cites PARE: Part attention regressor for 3D human body estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers PARE: Part attention regressor for 3D human body estimation,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.943929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.447524Z digest=sha256:065e0ff419fd6fb5bfa7c1f44c9e60d43d94badcc5fff4d5f6b0a034927b00d0

Observation 1d922cbe-ffd0-43d0-84d8-29993f125cff · outbound

This paper cites TORE: Token reduction for efficient human mesh recovery with transformer,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers TORE: Token reduction for efficient human mesh recovery with transformer,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.929654Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.451549Z digest=sha256:a7c80e803f52c901d3e5dad25efd87a19e6c32c3be08ab3c88b46ff1151491f3

Observation 16825822-1de4-4f87-95de-7e5d28a52f73 · outbound

This paper cites Beyond attentive tokens: Incorporating token importance and diversity for efficient vision transformers,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Beyond attentive tokens: Incorporating token importance and diversity for efficient vision transformers,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.914049Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.455632Z digest=sha256:43d4fd72f21f74273a1fdf84996b6a8634571ee20fb12d8c2caf0ce7c1e1b6cb

Observation 1f044c05-ba2c-4eed-a7c2-e00aa6a06667 · outbound

This paper cites SPViT: Enabling faster vision transformers via latency-aware soft token pruning,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers SPViT: Enabling faster vision transformers via latency-aware soft token pruning,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.897958Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.460009Z digest=sha256:8dae675b9a065e193c292e3ebcda1b326ef3407fb543dcc84d26dbdef42f2fd9

Observation 1c94fcc8-0c33-43b1-be83-e2decafff9b9 · outbound

This paper cites Making vision transformers efficient from a token sparsification view,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Making vision transformers efficient from a token sparsification view,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.883238Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.464202Z digest=sha256:63bb4661a45d10282a1adf4023efaed7d9814ba8d58628271691288de38d56ff

Observation 44989d90-63e7-4fe4-84ec-30e0756b8106 · outbound

This paper cites PPT: Token-pruned pose transformer for monocular and multi-view human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers PPT: Token-pruned pose transformer for monocular and multi-view human pose estimation,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.868634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.468245Z digest=sha256:86f4e2ca13474a024196247897bd688aff06a85b5ee9211f257302d55111e09a

Observation 3221ffe7-b8ce-40ef-8b86-23724007d868 · outbound

This paper cites TCFormer: Visual recognition via token clustering transformer,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers TCFormer: Visual recognition via token clustering transformer,

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.853539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.472243Z digest=sha256:9cf6f5a7eaba86c7dea251a457f586a024a867fe4584c6d29b0c12acb6503c25

Observation 31755350-e565-4318-9397-8375b1fff6be · outbound

This paper cites GTPT: Group-based token pruning transformer for efficient human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers GTPT: Group-based token pruning transformer for efficient human pose estimation,

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.839149Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.476398Z digest=sha256:4626d4d321c161cfc02d2a7eb94af68e700ce06ce13e9a5d801fb4613532aa61

Observation 8add3375-a0b0-4fa5-8ff6-e363868ba09c · outbound

This paper cites Deep residual learning for image recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Deep residual learning for image recognition,

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.480375Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.480375Z digest=sha256:e67b42e4e1672693979fea1c394fabd095af3b10e9696e51a32f616aa5719f18

Observation 025de195-5465-4dc4-bbc1-a8eb55e1cd6d · outbound

This paper cites Very deep convolutional networks for large-scale image recognition,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Very deep convolutional networks for large-scale image recognition,

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.484330Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.484330Z digest=sha256:fe08b0b8d8ed5c182e48b5c654d1b816d374c244d65d2013eb8a06deb8eb5d3a

Observation ed2c8055-c961-4e8a-b53f-bb351e8a0ebe · outbound

This paper cites Study on density peaks clustering based on k-nearest neighbors and principal component analysis,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Study on density peaks clustering based on k-nearest neighbors and principal component analysis,

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.804949Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.488372Z digest=sha256:adfec32d7486b7c87817c510a03e636442a69e139e6ac60f84f0588237a1d134

Observation 9f431092-4a39-4cef-b5b3-79be4d17ca39 · outbound

This paper cites A-ViT: Adaptive tokens for efficient vision trans- former,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers A-ViT: Adaptive tokens for efficient vision trans- former,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.790394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.492654Z digest=sha256:8d698dd77864bd8c0963cf8a8d869e137b2213921f55a0f82b6af2e903ca5241

Observation ddf73042-7a9d-4ec4-b425-5baf25628e11 · outbound

This paper cites Token pooling in vision transformers for image classification,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Token pooling in vision transformers for image classification,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.775728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.496580Z digest=sha256:c1ace34f37a6c8a6a6f970589f79abbf25bf34250be141899284a4796ef93eb9

Observation c14766e8-3162-44ee-b7b7-8662a0d84f71 · outbound

This paper cites Not all patches are what you need: Expediting vision transformers via token reorganizations,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Not all patches are what you need: Expediting vision transformers via token reorganizations,

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-04T22:55:44.500530Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T22:55:44.500530Z digest=sha256:6a5146132052abf06f352054ba7e02aaa16a57099db012e1a1b1c5eeceeb86eb

Observation 709eb1af-6c0c-465a-bcd1-e6402abdd3b1 · outbound

This paper cites DiffRate: Differentiable compression rate for efficient vision transformers,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers DiffRate: Differentiable compression rate for efficient vision transformers,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.750310Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.504684Z digest=sha256:9e89459e1d62cb01b95b3806989a59b79c7d6f90bafa83cf7fef682d8cc8cd6b

Observation cf2ea3d7-e078-4c4c-830b-dc40279e0c99 · outbound

This paper cites Multi-hypothesis represen- tation learning for transformer-based 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Multi-hypothesis represen- tation learning for transformer-based 3D human pose estimation,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.736258Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.508638Z digest=sha256:50659a15f6b2aaac330cbdd5bf1e0d2c9d2fbd4c7c63902db0f83c05d40ed6c7

Observation f6694fa0-cd82-48e2-ac50-0490df665126 · outbound

This paper cites Monocular 3D human pose estimation in the wild using improved CNN supervision,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Monocular 3D human pose estimation in the wild using improved CNN supervision,

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.721982Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.512665Z digest=sha256:cf4d872298b63d7df28f7f3ea9bc420a608116be71858c0d35aa48510a722690

Observation 590cb668-6de6-4437-9ea1-fd361814d127 · outbound

This paper cites GraphMLP: A graph MLP-like architecture for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers GraphMLP: A graph MLP-like architecture for 3D human pose estimation,

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.707947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.516824Z digest=sha256:4a6527a4503df9497ba8914ca76e1d039122123a5c4f003f925e537970e393b7

Observation 733b872b-2cc8-40a9-b763-72d2b1797d16 · outbound

This paper cites Locally connected network for monocular 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Locally connected network for monocular 3D human pose estimation,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.693301Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.521081Z digest=sha256:db1412bda7c46ac4c0280fe4a356d4b23a2e0a46d302a69abdb6669088746c62

Observation f9d0d24c-6b35-4d94-8a9a-8c8f73c5ee5a · outbound

This paper cites Monocular 3D pose estimation via pose grammar and data augmentation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Monocular 3D pose estimation via pose grammar and data augmentation,

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.679446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.525429Z digest=sha256:db51130d3b9740045c7c008eb36406e600a211ad3febc0ff811c39ea3094746a

Observation 01a8b894-ab54-46dd-a1a7-165d20417ddb · outbound

This paper cites Cascaded deep monocular 3D human pose estimation with evolutionary training data,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Cascaded deep monocular 3D human pose estimation with evolutionary training data,

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.664535Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.529400Z digest=sha256:d6c57f0b6f26d40005918c638c5d659278374608523bd7769719030be7423dd7

Observation e9f879f7-c10f-43a0-a4db-ad909c30732a · outbound

This paper cites Stacked hourglass networks for human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Stacked hourglass networks for human pose estimation,

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.648705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.533256Z digest=sha256:2e123c2cf56f14196fbd46bbba8b91fc777ba4f6379fc652e627990a03c5047b

Observation 99557aab-28cd-44ee-b8f7-2ff27b9f5003 · outbound

This paper cites 3D human pose estimation with spatio-temporal criss-cross attention,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers 3D human pose estimation with spatio-temporal criss-cross attention,

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.634297Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.537351Z digest=sha256:8ab0fd24a773cc4d439f25b2eff76f54b3bdc7ae639168a5130aa41858f033f7

Observation 3ecc00e2-7edd-4dd1-afa8-f9e5e502eaf1 · outbound

This paper cites KTPFormer: Kinematics and trajectory prior knowledge-enhanced transformer for 3D human pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers KTPFormer: Kinematics and trajectory prior knowledge-enhanced transformer for 3D human pose estimation,

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.619636Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.541340Z digest=sha256:d8f35c7c28992edf2c79f2bf010125168a394ed2579f27843c3bc632db44a280

Observation b2512e1e-6097-4b80-852c-95f7ac736f26 · outbound

This paper cites Diffusion-based 3D human pose estimation with multi-hypothesis aggregation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers Diffusion-based 3D human pose estimation with multi-hypothesis aggregation,

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.604436Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.545237Z digest=sha256:e5a34182430ae59dafdc731ba26859af0e880e72e60d8e6cc9839acf300faf2e

Observation 9f1a2e9f-c54e-40f0-aa13-113e6938cc00 · outbound

This paper cites DiffPose: Toward more reliable 3D pose estimation,.

H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers DiffPose: Toward more reliable 3D pose estimation,

Reference 67

Resolution
verified fuzzy
raw_fallback, observed 2026-08-04T22:55:44.588756Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-04T22:55:44.549338Z digest=sha256:ef76d45fde32c202f26c5b1fb58887e78f7818e5e9dde6220b17d6783be0946a

Pith citing papers

No inbound Pith citation observations are available.