{"as_of":"2026-07-22T02:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5afe8528e08635bd0ab4a72b98c7d4e6eb7d1ac1a83a3593cff73fc5dae4d5b9","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T10:09:08.788131Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-21T06:31:05.380196+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.17396/citation-record","integrity":"/paper/2603.17396/integrity","json":"/paper/2603.17396/citation-record.json","paper":"/paper/2603.17396"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d hand shape and pose from images in the wild","venue":null,"work_id":"874705b9-32be-4c96-a1ef-3e22f43175e6","year":2019},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:1f66a5d6e600f214c8edffd4708f112677bac4302d79d562a00a32666aff8128","observation_id":"170b51a1-8c57-460f-a13d-b15fdf53f3e5","resolution":{"observed_at":"2026-05-15T10:09:55.960044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Weakly-supervised 3d hand pose estimation from monocu- lar rgb images","venue":null,"work_id":"f8474de5-852e-4beb-b53b-61c57ff64b7c","year":2018},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:b32e2239e83487af576f22360401df6cd6d4fb755050bc56954765e20edceac3","observation_id":"56c5bb53-1b06-497c-b0a5-1c1ec954da17","resolution":{"observed_at":"2026-05-15T10:09:55.945734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Subunets: End-to-end hand shape and continuous sign language recognition","venue":null,"work_id":"ac6277ed-1649-49f9-8926-586e60db6f71","year":2017},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:c0191693a24e1ef5e44ec6dc8c02bff233716d02c73c642b429513dbad7ef526","observation_id":"308bbab6-b7f3-4af8-bf7a-9753160da935","resolution":{"observed_at":"2026-05-15T10:09:55.936267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model- based 3d hand reconstruction via self-supervised learning","venue":null,"work_id":"04cc4a87-2921-4c6d-b64b-fdcc5fc1e359","year":2021},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:e9a9d375114aa69138a7706a84352a84d35b8ad152fd5a9c235d93e467697796","observation_id":"4779bea9-bbda-4eb4-b3e0-052cd963a4ca","resolution":{"observed_at":"2026-05-15T10:09:55.951303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d hand shape and pose estimation from a single rgb image","venue":null,"work_id":"6df025c4-0244-4a4e-88b8-97ff0da7406e","year":2019},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:93ae3755b269a88b2b525ded8d3b53c232931b08ae0fd52c5fb18565fc7ecc42","observation_id":"ac6df174-ac59-4b8a-8940-ad650fd2f48a","resolution":{"observed_at":"2026-05-15T10:09:55.954692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"52c18ead-8b2c-4500-95c1-31c9d8e51cdd","year":2025},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:2508525d983e146fb2572baefdf44e3ca1ad51e98142dd4dd57af075fe45dfaa","observation_id":"b46ecf5f-5472-40e4-b8f7-4e2aaca38f01","resolution":{"observed_at":"2026-05-15T10:09:55.933200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FineHand: Learning hand shapes for american sign language recogni- tion","venue":null,"work_id":"560cee38-c7e8-4cfb-854a-37305db81383","year":2020},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:f2b43cfd78ddf7f28e3b4d07697b0ae961b42894c58c8f06ecfe33f9d8c5faa0","observation_id":"b5b90498-394d-4145-8a29-c5fff990bb34","resolution":{"observed_at":"2026-05-15T10:09:55.931379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Black, David W","venue":null,"work_id":"a0b62709-5ee3-4c33-85c1-dff1b5d536bd","year":null},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:4cd7cce47d35558c0039aa175d734af2aca9ad0b06cd9212ee5d1a189b9137b5","observation_id":"f6aad9fd-6980-47b1-a4a0-d85ad308b27f","resolution":{"observed_at":"2026-05-15T10:09:55.939491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep hand: How to train a cnn on 1 million hand images when your data is continuous and weakly labelled","venue":null,"work_id":"49d4478e-265c-4a99-a6ef-d72e0e089769","year":2016},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:8c7dd1bd2acc205ff20a26f49078f61c33ad4a57abc524b3c2f01b2b1bbf9d52","observation_id":"da98a552-ee9b-48e8-84d4-184c000d3738","resolution":{"observed_at":"2026-05-15T10:09:55.956261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Im2hands: Learning attentive implicit representa- tion of interacting two-hand shapes","venue":null,"work_id":"345e07e3-5258-432d-8184-e4247e58eaaf","year":2023},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:a3b0fa3c302427e324ae46cd4517478ec2deabe9e06688e6c1b49124b67d1a61","observation_id":"745a307d-92c3-4607-b54d-358d99af6509","resolution":{"observed_at":"2026-05-15T10:09:55.959033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interacting attention graph for single image two-hand reconstruction","venue":null,"work_id":"a7bf9d8f-ba76-4dfb-a550-b81dde69c266","year":2022},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:8d1787167792ebd991685b18421ac5e2c9923ba4c79833b0140c39908960d683","observation_id":"17bb5d8f-76f2-4e5c-80d8-496a443334bc","resolution":{"observed_at":"2026-05-15T10:09:55.927951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interhand2","venue":null,"work_id":"f931ab2c-9efb-4705-b173-1c31441bc1b1","year":2020},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:744d9f97391d697f483e1e63cb169c4c9b548be587e918a38b7cd14f2af818a5","observation_id":"9c242acd-1ce8-46d6-9956-b782f3aa81e6","resolution":{"observed_at":"2026-05-15T10:09:55.948284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Extract-and-adaptation network for 3d interacting hand mesh recovery","venue":null,"work_id":"98b7f75b-cb2e-4495-aaea-1f2b8e87bb5e","year":2023},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:1a0e3e1d7aa8c08389803ffdd5144e21699bf74ccd25a8838a1e2421009d94c5","observation_id":"b9609050-e55e-4e54-ad6e-b84c13efb5ee","resolution":{"observed_at":"2026-05-15T10:09:55.930646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recon- structing hands in 3d with transformers","venue":null,"work_id":"9f80c13d-e5c2-4b0c-9b1d-634283146910","year":2024},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:1aa1992614e29e3b9a261fe9db3d9acb5e77dda2cca4334f467b393dd8628587","observation_id":"70249d40-d82d-449c-93a0-db387fb8fb9f","resolution":{"observed_at":"2026-05-15T10:09:55.992110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wilor: End-to-end 3d hand localization and reconstruction in-the-wild","venue":null,"work_id":"7fdc3c97-bcca-4399-af57-dd1c97865f31","year":2025},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:91447779977bdc34967a5793cff0179de1775f37d8cc033faf22ff52868a3b56","observation_id":"41961a09-5d10-4470-b7a2-60b006ae50a6","resolution":{"observed_at":"2026-05-15T10:09:55.981239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Em- bodied hands: Modeling and capturing hands and bodies to- gether","venue":null,"work_id":"551fa0f6-d7bd-472f-845b-38557976f25d","year":2017},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:6f321b4f8397637f3337d931523335c99761e2d6b768ec0198218a57e612f422","observation_id":"1fa789ba-baad-4b41-a281-4c054f0ea301","resolution":{"observed_at":"2026-05-15T10:09:55.968478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Frankmocap: A monocular 3d whole-body pose estimation system via re- gression and integration","venue":null,"work_id":"2d7af910-55b7-44b4-8e02-0a65d7deb547","year":2021},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:4792dc2a83bc01770a1ed5f8098a0eb8f70dff57a442597c4988c0af265a9d3a","observation_id":"cd6c8106-3372-4294-b1dc-b6541dd54cd1","resolution":{"observed_at":"2026-05-15T10:09:55.971683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep high-resolution representation learning for human pose es- timation","venue":null,"work_id":"d9540a1c-6fd7-4163-b03a-9f8487c2a569","year":null},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:9253ad4830c05657a38e86d104b683b139c23f7cba020c7fe5417ef2a510b436","observation_id":"61bea5fb-e3e3-452c-9869-025bf2dd4c7c","resolution":{"observed_at":"2026-05-15T10:09:55.987349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.04514","last_updated":"2019-04-09T08:08:16Z","snapshot_observed_at":"2026-07-06T07:44:54.113537Z","submitted_at":"2019-04-09T08:08:16Z","title":"High-Resolution Representations for Labeling Pixels and Regions","version":1},"cited_work":{"arxiv_id":"1904.04514","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.04514","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-Resolution Representations for Labeling Pixels and Regions","venue":"cs.CV","work_id":"e3784ec2-0736-486a-9ed8-5c328c1a780f","year":2019},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"cited_paper":"/paper/1904.04514","citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:5c327e7baee96cd4b0a7e4ffcb98c735423cf8dbb309a82a5de4aff700874d46","observation_id":"9a5bf11b-bb65-448b-87d5-3b5a833fd2fc","resolution":{"observed_at":"2026-05-15T10:09:55.374303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep high-resolution repre- sentation learning for visual recognition.IEEE transactions on pattern analysis and machine intelligence, 43(10):3349– 3364","venue":null,"work_id":"d3a04cc2-da69-440b-b544-2247888e00dc","year":2020},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:cb287214165c0a8ee099c3bc7a04088ed6974d5a636f3d8489684c84ec517404","observation_id":"e36968a3-417a-40fb-802d-5e93df4bdb91","resolution":{"observed_at":"2026-05-15T10:09:55.974920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.05079","last_updated":"2020-08-12T03:13:17Z","snapshot_observed_at":"2026-07-06T09:46:29.250376Z","submitted_at":"2020-08-12T03:13:17Z","title":"BiHand: Recovering Hand Mesh with Multi-stage Bisected Hourglass Networks","version":1},"cited_work":{"arxiv_id":"2008.05079","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2008.05079","snapshot_observed_at":"2026-07-04T19:40:07.318015Z","title":"Bihand: Recovering hand mesh with multi- stage bisected hourglass networks","venue":null,"work_id":"a71032fe-6dda-4b18-b18d-302251c199b6","year":2008},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"cited_paper":"/paper/2008.05079","citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:b00d9d6f8df2f1be48be9831055940acaa561ef400f4ff0aa33d09d6277c9bdc","observation_id":"5f75b008-5df5-47bd-a253-634456106509","resolution":{"observed_at":"2026-05-15T10:09:55.372954Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Acr: Attention collaboration-based regres- sor for arbitrary two-hand reconstruction","venue":null,"work_id":"d39d81b6-4023-4926-b8da-716cb10f1a62","year":2023},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:b7484eddd13091b927d3cface3dc11b8cb0bc54970c0c6567309ba63d06eb537","observation_id":"bb34265d-a893-40d4-a77d-14f514cec13b","resolution":{"observed_at":"2026-05-15T10:09:55.965736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the continuity of rotation representations in neural networks","venue":null,"work_id":"3082d629-ccad-42e4-a1b6-88a5eddaad8b","year":null},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:cd92563e700c1bce0f9b15fbd97070dcf1609cd3175872355ac2385a9343eaee","observation_id":"a865a8db-3dec-473f-a747-822ef0a517aa","resolution":{"observed_at":"2026-05-15T10:09:55.962955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monocular real- time hand shape and motion capture using multi-modal data","venue":null,"work_id":"3d07bbef-8845-4dcd-a25a-cc4a9f6c9a07","year":2020},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:cc8d641425f90d47078e907efe659929892e25964181f2afb00c11b19f904fad","observation_id":"bdeb5adb-f73c-41da-b8d1-7f2c62fbd5ff","resolution":{"observed_at":"2026-05-15T10:09:55.978207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Freihand: A dataset for markerless capture of hand pose and shape from single rgb images","venue":null,"work_id":"c121bafb-f7f3-4c8a-a4cd-054328a9c84f","year":2019},"citing_paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T10:09:08.788131Z"},"links":{"citing_paper":"/paper/2603.17396"},"observation_digest":"sha256:83e9c0a5f135de2c974fbaedb9bb8b5701ffd6bb3627d0fb0fce587fae7c571f","observation_id":"75bb7e56-a00e-49af-9717-409064a9047d","resolution":{"observed_at":"2026-05-15T10:09:55.984325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-21T06:31:05.380196+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.17396","last_updated":"2026-04-07T13:46:31Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:49:28.866886Z","submitted_at":"2026-03-18T06:18:46Z","title":"Gesture-Aware Pretraining and Token Fusion for 3D Hand Pose Estimation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":2,"verified_fuzzy":23},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-21T06:31:05.380196+00:00","source":"crossref"},{"observed_at":"2026-07-21T06:31:00.184556+00:00","source":"retraction_watch"}],"thesis":"As of 22 July 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2603.17396."}