{"as_of":"2026-08-23T17:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea9f69a573bb76119d27bf7cfee7db5f6a6fd2aabda5af258784184c16f58b79","coverage":[{"denominator":242,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:41:07.977777Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T21:44:23.463544Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T21:44:23.537258Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"cited_work":{"arxiv_id":"2501.11992","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11992","snapshot_observed_at":"2026-08-07T21:44:23.537258Z","title":"Survey on Hand Gesture Recognition from Visual Input","venue":"cs.CV","work_id":"1a74bb9e-2718-4124-8c1a-3255439e9668","year":2025},"citing_paper":{"arxiv_id":"2502.09379","last_updated":"2025-02-27T09:07:06Z","snapshot_observed_at":"2026-08-14T17:41:22.119438Z","submitted_at":"2025-02-13T14:46:40Z","title":"TRIFFID: Autonomous Robotic Aid For Increasing First Responders Efficiency","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T21:44:23.463544Z"},"links":{"cited_paper":"/paper/2501.11992","citing_paper":"/paper/2502.09379"},"observation_digest":"sha256:2bfa8bd7eed1e6d873d9477319be809f3453ed14f6a228df6fde7d29e8dc6c84","observation_id":"26ab7bfa-32c6-4221-936a-4addb1e63c9c","resolution":{"observed_at":"2026-08-07T21:44:23.541355Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.11992/citation-record","integrity":"/paper/2501.11992/integrity","json":"/paper/2501.11992/citation-record.json","paper":"/paper/2501.11992"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.653210Z","title":"Spatial–temporal feature-based end-to-end fourier network for 3d sign language recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.653210Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:2bd742f704a9708055eb55694d3692be73e4216bb77ccf3bba6515fbaabc7619","observation_id":"57991398-a10c-414b-b05c-3f49814c92a7","resolution":{"observed_at":"2026-08-10T17:41:07.653210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.657463Z","title":"Papadopoulos, Vassia Zacharopoulou, George J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.657463Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:7a7dbe497e83270082fd6f9f637543b72ca328870b5893f9fba9c689202b4d58","observation_id":"a55d802f-d875-45ec-b43b-d3d6805a465b","resolution":{"observed_at":"2026-08-10T17:41:07.657463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.660825Z","title":"Enhancing hand gesture image recognition by integrating various feature groups","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.660825Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:cc5c6091b91ad864da3b6c2d6eedef73d4213636759284bf8003b3297e7055e4","observation_id":"d892aeeb-50da-418e-a7fc-0cded50d5ec0","resolution":{"observed_at":"2026-08-10T17:41:07.660825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11932","last_updated":"2023-01-30T10:21:09Z","snapshot_observed_at":"2026-08-20T03:04:22.007725Z","submitted_at":"2023-01-30T10:21:09Z","title":"RGB Arabic Alphabets Sign Language Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11932","snapshot_observed_at":"2026-08-10T17:41:07.664492Z","title":"Rgb arabic alphabets sign language dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.664492Z"},"links":{"cited_paper":"/paper/2301.11932","citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:fa39197b02c3ce4c617000afd99224512cf55d57ac47914d8dab8fca0b10483a","observation_id":"49c55515-3044-4184-8548-5fbcb326c374","resolution":{"observed_at":"2026-08-10T17:41:07.664492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.667944Z","title":"A structured and methodological review on vision-based hand gesture recognition system","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.667944Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:13b74bbf2407bce6074d4e6264310b5d547e2edac4a857aebce575629de60a7f","observation_id":"33f480db-f637-4187-ba43-b9a678e62a43","resolution":{"observed_at":"2026-08-10T17:41:07.667944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.670869Z","title":"Innovative hand pose based sign language recognition using hybrid metaheuristic optimization algorithms with deep learning model for hearing impaired persons","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.670869Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:e42ddb4e800918f4a57df0b79345812a756bdcfd964cc6e7e542ea01b0f440dc","observation_id":"30a4c081-5847-485e-ad79-8e4cc99a0efa","resolution":{"observed_at":"2026-08-10T17:41:07.670869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.674255Z","title":"Real-time sign language recognition based on yolo algorithm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.674255Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:196c91587514ad7891daf9db52e2c6cecbfd146b3ad920b3f1a8275881c7f770","observation_id":"ec612008-72b6-4c3f-a8ed-aa4d215cacad","resolution":{"observed_at":"2026-08-10T17:41:07.674255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.677258Z","title":"A survey on sign language literature","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.677258Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:64032217e784b3277ea5c7fc267f451e42afa207e8d4924d0f32aa67da545b52","observation_id":"39c7ea8a-b4ee-4a74-a61e-1c9e857546e5","resolution":{"observed_at":"2026-08-10T17:41:07.677258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.680286Z","title":"Snapture—a novel neural architecture for combined static and dynamic hand gesture recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.680286Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:cf2bacbcd26ef9bfe79e44f6a6517230dfea7d74cca17a49deb0bff3b5ee390e","observation_id":"5f56785d-3b30-4887-8cb4-fcb018d164cd","resolution":{"observed_at":"2026-08-10T17:41:07.680286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.683831Z","title":"Posetrack: A benchmark for human pose estimation and tracking","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.683831Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:4b103121a437d84d93b0c2a611eb22c00cf6aa867f10f1c8f4a21a847806872d","observation_id":"86937feb-67bc-4aa3-becd-6d9ebd3d4590","resolution":{"observed_at":"2026-08-10T17:41:07.683831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.687389Z","title":"The american sign language lexicon video dataset","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.687389Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:53f0bb1482f41c3b4d7bd4eb7113c017c0b2bae76ae2c878df0d57cb82503869","observation_id":"56434d2b-88cd-4d80-ab78-b7f2f6ec3e6c","resolution":{"observed_at":"2026-08-10T17:41:07.687389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.690680Z","title":"3d hand pose and shape estimation from rgb images for keypoint-based hand gesture recogni- tion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.690680Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:6eafb0a7546ac5857dc571bd7ec124359fa1fba4b9cf41be71d207e12025fdb2","observation_id":"049745ab-76d0-4c53-b1c9-e956085037cc","resolution":{"observed_at":"2026-08-10T17:41:07.690680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.694316Z","title":"Local extrema min-max pattern: A novel descriptor for extracting compact and discrete features for hand gesture recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.694316Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:4672f739e014fd537708508380688d190c3b1d7c7c9cd33d0aff7451347672b4","observation_id":"70ac78c1-7178-4276-baa4-a799c8d37703","resolution":{"observed_at":"2026-08-10T17:41:07.694316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.697912Z","title":"A hybrid approach for static hand gesture recognition with integrated bigru- bilstm and sequential self-attention mechanism","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.697912Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:9d6a429ed3eb2da46ee73691fe0099f631d3b824fa0146cc842759ef17355486","observation_id":"eb1a97de-7773-4e1c-8ebe-9f4e8d5a3fa7","resolution":{"observed_at":"2026-08-10T17:41:07.697912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.701486Z","title":"Multimodal fusion hierarchi- cal self-attention network for dynamic hand gesture recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.701486Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:b00fe0e774fd279592fa5dd24429f12917d1265ef865f0905fdfa682952ac519","observation_id":"7a491b19-43af-4b51-8348-516c3d302950","resolution":{"observed_at":"2026-08-10T17:41:07.701486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.704952Z","title":"Ultra-range gesture recognition using a web-camera in human–robot interaction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.704952Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:fab852b10ae6944509bf6a6a34ab447d04ae47d20a28a35b2e02217e8d5cccc0","observation_id":"b12dc3f4-619e-4420-b086-cbf528ca0ed6","resolution":{"observed_at":"2026-08-10T17:41:07.704952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.708509Z","title":"A new 2d static hand gesture colour image dataset for asl gestures","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.708509Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:6e120e5fdc36b318bd1e066c9af1f6eb2558a9f0d7bbe9c3f156d91d979f2c1d","observation_id":"6ee606b0-8478-4d37-9d59-51fa88eb3923","resolution":{"observed_at":"2026-08-10T17:41:07.708509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.712216Z","title":"Improving real- time hand gesture recognition with semantic segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.712216Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:122c5bc7e67275a447114345cfc0546e01edfd51f57ec095c6419f458aee223a","observation_id":"b42ddbf0-b19a-4604-add9-8d8bdee80324","resolution":{"observed_at":"2026-08-10T17:41:07.712216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.715744Z","title":"Video based hand gesture recognition dataset using thermal camera","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.715744Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:08e32c350ffad02812c8cf7ede8a94226bc7c69fa9ab5c70291cffe03c8ec4b1","observation_id":"20147427-19d9-4c17-b793-4e0f45149d6f","resolution":{"observed_at":"2026-08-10T17:41:07.715744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.719192Z","title":"Weakly- supervised 3d hand pose estimation from monocular rgb images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.719192Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:39e36ec698c49d80ab11dd5b011a5e788315fdbc1c039e9a585670d22b2d1fab","observation_id":"f1404c5a-f307-46d0-82f0-0408168eceda","resolution":{"observed_at":"2026-08-10T17:41:07.719192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.722244Z","title":"Exploiting spatial-temporal re- lationships for 3d pose estimation via graph convolutional networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.722244Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:18b34355899ef26d3845b935fed1f86cb23d7a8fc4e586c7bad464add362946d","observation_id":"4d96dc69-7984-4222-b7ea-0f873a5373c1","resolution":{"observed_at":"2026-08-10T17:41:07.722244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.725640Z","title":"Neural sign language translation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.725640Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:dce2d4ce5e3d317056aa460fa0089f4165821ff5a3a691fb2cec8accb27ff1cb","observation_id":"2e926884-bcf5-4986-b5b7-2f66fe864e87","resolution":{"observed_at":"2026-08-10T17:41:07.725640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.728700Z","title":"Sign language recognition for assisting the deaf in hospitals","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.728700Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:decc50d2f6a42f3489b4e9ab90d630e7432c846c15168ed5a375e7af5cd6c0e1","observation_id":"2dc6bf0c-d064-45f9-bcff-f162098f036a","resolution":{"observed_at":"2026-08-10T17:41:07.728700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.731710Z","title":"Emerging properties in self-supervised vision transformers, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.731710Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:867c52fb962c77bc4c28982895e51a41a803d903f7a494d5a4e539ab45fb1583","observation_id":"2be34a98-f29b-4de8-9122-3fbf9307f8bf","resolution":{"observed_at":"2026-08-10T17:41:07.731710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.734413Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.734413Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:6b77666221144f27c9a739268e8dadde37feb6b465707659477b7b61e50ad713","observation_id":"bfcfb143-d5ce-48bf-8093-7a84e1b6d1b0","resolution":{"observed_at":"2026-08-10T17:41:07.734413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.737449Z","title":"Hand-gesture recogni- tion based on emg and event-based camera sensor fusion: A benchmark in neuromorphic computing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.737449Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:8d29b37f2478f3cc872c33f68ad3cc2b1916782cc60dad6bc466b1f47f88bdc5","observation_id":"9870f18e-e934-4299-9475-7881005d960c","resolution":{"observed_at":"2026-08-10T17:41:07.737449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.740172Z","title":"Dexycb: A benchmark for capturing hand grasping of objects","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.740172Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:cd75a9896f41ab384579ad88b756868efc8becf332a8333042880fedab0a4678","observation_id":"d04ec5c8-d691-4a92-9181-521b0f71e452","resolution":{"observed_at":"2026-08-10T17:41:07.740172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.742994Z","title":"Convolutional neural network hand gesture recognition for american sign language","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.742994Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:883fe5dc667f0f2f763dfe9c82cbf919208dabebbe6abc3a5727848d9e32400a","observation_id":"68f4a7f4-e53a-4ff5-bf50-85a2590b357b","resolution":{"observed_at":"2026-08-10T17:41:07.742994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.745800Z","title":"Multi-scale attention 3d convolutional network for multimodal gesture recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.745800Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:23ab75ef237b8725c18ac4235780ccc926a85ed2e0c3126b1b7125cc2a50ecc8","observation_id":"6f39e446-58cd-4a0f-bdbb-55b87bc6b445","resolution":{"observed_at":"2026-08-10T17:41:07.745800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.748854Z","title":"Lisa: Learning implicit shape and appearance of hands, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.748854Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:01f411219897c8425fd289dcba4fdeb9492f8e2ccb080e4a081806e8e862650b","observation_id":"ff0e20d7-705a-4fd1-ba4e-6c2f8251975a","resolution":{"observed_at":"2026-08-10T17:41:07.748854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.751695Z","title":"Dabwan, Mukti E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.751695Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:ca90d2843127cd2d3f611939c8a661967c82361e1f94af5ac810cb215456e453","observation_id":"467cd229-bcbc-417b-8350-caf13ec955e2","resolution":{"observed_at":"2026-08-10T17:41:07.751695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.755271Z","title":"Histograms of oriented gradients for human detection","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.755271Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:951b1ed849ad5a91b7e179e62442cec900c2fc6c90b4e0328baeea3674c18929","observation_id":"2adcbd5c-cd32-4118-ab8e-626af986c2de","resolution":{"observed_at":"2026-08-10T17:41:07.755271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.758936Z","title":"Scaling egocentric vision: The epic-kitchens dataset","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.758936Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:a67caeb5117d7418ec863d2457d03aeb0c8813859185bfc1fdf03bfe3aca1d5b","observation_id":"883f74d3-fbda-4fdc-97bb-d89440be7d82","resolution":{"observed_at":"2026-08-10T17:41:07.758936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.762739Z","title":"Cnn based static hand gesture recognition using rgb-d data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.762739Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:68a5830332068cf4b9e2149db3034ee97b39a091a2e1c3664a2d24bbc333567c","observation_id":"c1ecdca1-c360-4d0c-8752-43bdcd71b961","resolution":{"observed_at":"2026-08-10T17:41:07.762739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.765965Z","title":"Spatial-temporal graph convolutional networks for sign language recog- nition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.765965Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:e39887b8d06fb0ede6577ab8474fb1c7ff2b783f257fafd379e32a08f0dbd4a0","observation_id":"61bb6d59-a43c-4537-8aa1-d76ac784251e","resolution":{"observed_at":"2026-08-10T17:41:07.765965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.769447Z","title":"Automatic translation of sign language with multi-stream 3d cnn and generation of artificial depth maps","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.769447Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:aa6980d805ae0feeff0ec03e42503813c12ed6c85052f3b6d43f2c3be605ef84","observation_id":"a50fcbce-8d7c-46f2-870e-1864eec9e889","resolution":{"observed_at":"2026-08-10T17:41:07.769447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.772729Z","title":"Isolated sign recognition from rgb video using pose flow and self-attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.772729Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:50a2a5bc524f6a1c0374691e0288eeee3b8552cd5b6198e0a4037847d1d33947","observation_id":"3cc11790-4300-4fad-b8ed-9ca3c5ef6ae9","resolution":{"observed_at":"2026-08-10T17:41:07.772729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.775932Z","title":"Skeleton-based dynamic hand gesture recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.775932Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:26f37e64ca969f73f8da2a8a9c66931f10f31de72c5c87ab885e95767e3dd878","observation_id":"8ebd61a4-a182-4874-b8d2-7d8232b84122","resolution":{"observed_at":"2026-08-10T17:41:07.775932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.779330Z","title":"Heterogeneous hand gesture recognition using 3d dynamic skeletal data","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.779330Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:3d7e7bca39dbedcbc6dfd60af9b0aa316d86e0b82c1e6c976ce4b094c19089be","observation_id":"6675701a-bf3d-46a1-b93c-ed1575d9d285","resolution":{"observed_at":"2026-08-10T17:41:07.779330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.782738Z","title":"Shrec’17 track: 3d hand gesture recognition using a depth and skeletal dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.782738Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:46fa35e1a7bef9b8b2319af6ec6ff14d6ffda3d2958bc3f959c6c7fc9afb3971","observation_id":"7687f137-e2a7-4591-a06d-512dd91d6683","resolution":{"observed_at":"2026-08-10T17:41:07.782738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.786228Z","title":"Tms-net: A multi-feature multi-stream multi-level infor- mation sharing network for skeleton-based sign language recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.786228Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:8282d5bd1265456d627bbaa759dbe4f3f9019e6b8d2f8ce1e864c39d15b65890","observation_id":"542a7ea1-cabb-4d88-afd5-d7389dbafb15","resolution":{"observed_at":"2026-08-10T17:41:07.786228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.789824Z","title":"Deep learning for hand gesture recognition on skeletal data","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.789824Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:ab112d464326268c72e9be8d021cfd3e2a6197268d02b048579e3dab40df2477","observation_id":"13cc5e74-0083-42ae-8365-b604281531a9","resolution":{"observed_at":"2026-08-10T17:41:07.789824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.792994Z","title":"Modeling image variability in appearance-based gesture recognition","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.792994Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:bc1c97fdc3bc12f47ec412d5de13ea3caada5e26eb00a5268992431981773612","observation_id":"2cd48467-5312-47a6-bb4a-e5a045393799","resolution":{"observed_at":"2026-08-10T17:41:07.792994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.795984Z","title":"Beyond granularity: Enhancing continuous sign language recognition with granularity-aware feature fusion and attention optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.795984Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:769966928bba01b69fbde5394a542d9677e855611b8e1c23205815399897983a","observation_id":"3d381307-e561-4557-8d77-074efe3f24ab","resolution":{"observed_at":"2026-08-10T17:41:07.795984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.798851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.798851Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:142652ebb4440ac7eaa498c6716faf41544ae5a4d56ca2dcad4ca1c47f1ec096","observation_id":"19704ba3-0e00-48e7-ad35-e48903a9d96a","resolution":{"observed_at":"2026-08-10T17:41:07.798851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.801926Z","title":"Lavrf: Sign language recognition via lightweight attentive vgg16 with random forest","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.801926Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:d3bdf5e75676b657502ee1cdd4a10b133d50de9bacd5efb6e50b1af95106538e","observation_id":"ba7c6153-b3e6-4d0a-93fd-49141a4fade5","resolution":{"observed_at":"2026-08-10T17:41:07.801926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.805217Z","title":"Multi-task and multi-modal learning for rgb dynamic gesture recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.805217Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:a3c2e07edbe3391b73a6b3b946ccf1d96301b7735b2b09750a618bc9e8d20c8b","observation_id":"b47faa0a-d100-480b-af31-cfacc38c3831","resolution":{"observed_at":"2026-08-10T17:41:07.805217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.808136Z","title":"Mdsi: Pluggable multi-strategy decoupling with semantic inte- gration for rgb-d gesture recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.808136Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:0734b6797d4d73f5a47c3ad2558e1d121b4a02b57a7506621cf6860516da80fa","observation_id":"ac637cdf-19b5-4e35-b738-4b60e7b6d0b9","resolution":{"observed_at":"2026-08-10T17:41:07.808136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.811064Z","title":"Yolov8-g2f: A portable gesture recognition optimization algorithm","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.811064Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:2f3563dec87a4b8051bca00dabf10a4337e1eae36a956002e3f2bf54caf6a05f","observation_id":"a36c682e-a6ff-4b2d-adce-d0f9aebc21b2","resolution":{"observed_at":"2026-08-10T17:41:07.811064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.814146Z","title":"Hand gesture recognition on edge devices: Sensor technologies, algorithms, and processing hardware","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.814146Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:4be02a0134ce3b57fb1c6d086231dcdb32f6f8fcbf4d655581bab17b85e2d2c7","observation_id":"6fcd73fa-6ced-46e4-b408-64dcdc25e5ac","resolution":{"observed_at":"2026-08-10T17:41:07.814146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.817182Z","title":"An efficient rgb-d hand gesture detection framework for dexterous robot hand-arm teleoperation system","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.817182Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:9827df2dfd43a49b7fa00c4751507fff47d77c11fe40c66664926d33e9a17a70","observation_id":"a47dc7be-76ac-4925-b655-1447def5d91c","resolution":{"observed_at":"2026-08-10T17:41:07.817182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.820050Z","title":"First-person hand action benchmark with rgb-d videos and 3d hand pose annotations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.820050Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:36f5d962a900a059626329429a48393462338c0319e74ea581182d8b0634fb00","observation_id":"a77bc40d-c3f9-4362-8a56-f940439a27b3","resolution":{"observed_at":"2026-08-10T17:41:07.820050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07118","last_updated":"2024-12-02T17:11:07Z","snapshot_observed_at":"2026-08-16T13:01:06.487395Z","submitted_at":"2024-11-11T16:45:18Z","title":"ConvMixFormer- A Resource-efficient Convolution Mixer for Transformer-based Dynamic Hand Gesture Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07118","snapshot_observed_at":"2026-08-10T17:41:07.823331Z","title":"Convmixformer-a resource-efficient convolution mixer for transformer-based dynamic hand gesture recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.823331Z"},"links":{"cited_paper":"/paper/2411.07118","citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:22a9941e57e446965878acc794e85f805f94364e6fbc12284f007b306d472907","observation_id":"dd7c1191-0514-4a0c-bb7d-47fd3d695396","resolution":{"observed_at":"2026-08-10T17:41:07.823331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.827129Z","title":"Gestformer: Multiscale wavelet pooling transformer network for dynamic hand gesture recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.827129Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:2b32fc37c4aad70ab09967fc620dab55445409b6578772269bbe65bf51d6f8c4","observation_id":"1373fb70-f402-485e-acb2-b01d56416641","resolution":{"observed_at":"2026-08-10T17:41:07.827129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.830647Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.830647Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:6d1a48f05d833f7e15beadab78c152bc3d1ab6a823533924899734b5f6876615","observation_id":"77bb7428-901c-4b8e-98d7-6723577b306d","resolution":{"observed_at":"2026-08-10T17:41:07.830647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.833928Z","title":"The role of gesture in communication and thinking","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.833928Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:6b196974d1201a0dac7a4afe2937cefa71ee2bf2928d99de09ce23a8e04f830d","observation_id":"20630820-6ddc-4a15-b846-4ddf05d37399","resolution":{"observed_at":"2026-08-10T17:41:07.833928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.837100Z","title":"Towards end-to-end speech recog- nition with recurrent neural networks","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.837100Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:393b08a2983f1ac594e645125177e5bfb5eec5390403731c41433abf6bebdd0f","observation_id":"cc270b7f-07cf-49c2-ae4b-61ef33c05076","resolution":{"observed_at":"2026-08-10T17:41:07.837100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.840734Z","title":"Mska: Multi-stream keypoint attention network for sign language recognition and translation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.840734Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:7647fc663d8aaedf6ac90b945d595af33e64337785cc816dd8ed8a49c3c75b79","observation_id":"fc94e2f8-96fd-4271-a88d-0fd0e2cc8894","resolution":{"observed_at":"2026-08-10T17:41:07.840734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.844073Z","title":"Multi-view isolated sign language recognition based on cross-view and multi-level transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.844073Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:91cc96fdbfdf6350b87083dfb671886008a834b4aa8b8207c04bf86b9520e3b6","observation_id":"b64ad37c-d1d9-4730-8211-2cdc716a08ac","resolution":{"observed_at":"2026-08-10T17:41:07.844073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.847439Z","title":"A hierarchical attention gcn network for body-hand gesture recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.847439Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:7b9e6e7b8c7f62c09d2ddcf54b4d9d49c17b822332af737efe94c0f0f8edbce1","observation_id":"8ff7afe4-e9c4-458c-ac80-95e94c512c19","resolution":{"observed_at":"2026-08-10T17:41:07.847439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.850748Z","title":"A rapid adaptation approach for dynamic air-writing recognition using wearable wristbands with self- supervised contrastive learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.850748Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:708dca70070b9bda1738c9d014bc20efa61eb65bf2445ab7af104f23e4cda4ff","observation_id":"4bf1c1fe-5ae9-4a7a-85e8-53d6e82dc73f","resolution":{"observed_at":"2026-08-10T17:41:07.850748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.854048Z","title":"Honnotate: A method for 3d annotation of hand and object poses","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.854048Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:1995016cd66c05f0a9d792f58136c8ccb599a8380e7c331f4a9a7b9f768bd640","observation_id":"b1fad607-b408-4738-8fb2-ad42deb00703","resolution":{"observed_at":"2026-08-10T17:41:07.854048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.857452Z","title":"A systematic review of hand gesture recognition: An update from 2018 to 2024","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.857452Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:1618754d68ccea4872a8dff70367824e333998254a5bf6ed128db45f4df81ac3","observation_id":"635c3a98-4d09-4e24-84a3-61cfbb38570a","resolution":{"observed_at":"2026-08-10T17:41:07.857452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.860914Z","title":"Developing a real-time hand exoskeleton system that controlled by a hand gesture recognition system via wireless sensors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.860914Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:8f39727e740cafa6f386b7571afc962049a8f8620d43d0c3212eafa17a5d868c","observation_id":"8755522f-18ea-42d0-8edd-d837aed761af","resolution":{"observed_at":"2026-08-10T17:41:07.860914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.863726Z","title":"Distilling the knowl- edge in a neural network, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.863726Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:0d51f67e505719758f20080253843c52d80a5de5f211b7bd84d5d4605e4db00b","observation_id":"600d5bc5-f2cf-4034-bfbb-ba75605947ec","resolution":{"observed_at":"2026-08-10T17:41:07.863726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.866596Z","title":"Efficient multimodal fusion for hand pose estimation with hourglass network","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.866596Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:4f8f5758089030a8aa2359341728b2d62fe3c6f244e98a1d9624ff268443babb","observation_id":"49aa71f2-29a1-48eb-8d2b-bfc7f7cffedb","resolution":{"observed_at":"2026-08-10T17:41:07.866596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.869278Z","title":"Bdsl36: A dataset for bangladeshi sign letters recognition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.869278Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:be5fa17f65b03b18ff4395ffc9513dd34feb7f6960810c7829f73291bb957da4","observation_id":"2f9f5ed5-de0e-452c-af7d-9781bd7c393d","resolution":{"observed_at":"2026-08-10T17:41:07.869278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.871752Z","title":"Howard, Menglong Zhu, Bo Chen, Dmitry Kalenichenko, Weijun Wang, Tobias Weyand, Marco Andreetto, and Hartwig Adam","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.871752Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:7ac3680920a0cbb97ddc0a61501db12adaaf42d9aa10fc7e1baf9324c15c8182","observation_id":"2720be20-d6dd-43ff-98e8-c2e9ca6f5bee","resolution":{"observed_at":"2026-08-10T17:41:07.871752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.874299Z","title":"Stfe-net: A spatial- temporal feature extraction network for continuous sign language translation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.874299Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:d5ce01acba5556c46c907b6a173f4161f96bd8a3a62857e204c3a2aa55980081","observation_id":"58eb36e0-f94b-468d-80a2-65d58018d1c5","resolution":{"observed_at":"2026-08-10T17:41:07.874299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.877090Z","title":"Hand gesture recognition algorithm using svm and hog model for control of robotic system","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.877090Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:7bb69851df75058104df95f7b41f1e0d780a08a5c775b8a52731a65fd6913412","observation_id":"2ac9fc8e-178d-4741-8a31-d933afffa1b9","resolution":{"observed_at":"2026-08-10T17:41:07.877090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.879745Z","title":"Iandola, Song Han, Matthew W","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.879745Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:f34669a7838070db66c56049d97087191b8e576c88f744966e1fa6419139d143","observation_id":"74be5497-aa02-4188-b523-6afca963bc3d","resolution":{"observed_at":"2026-08-10T17:41:07.879745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.882388Z","title":"Tools and approaches for topic detection from twitter streams: survey","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.882388Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:ebd5ee2194a76865a71010c74928aaf3cb6bd8dde36b86742c4c636495918dfa","observation_id":"defbab28-7141-4c48-9c6e-6d198e6a42fe","resolution":{"observed_at":"2026-08-10T17:41:07.882388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.886094Z","title":"Dataset of pakistan sign language and automatic recognition of hand configuration of urdu alphabet through machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.886094Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:d6ed005d4370cc4a7ccd29a4211cc8df6d680597ca55320884da06e40102fbd2","observation_id":"a7632ec0-7f24-49f6-9c6d-231313a0ca65","resolution":{"observed_at":"2026-08-10T17:41:07.886094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.889803Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.889803Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:453a504924820a909043c9d8f4b8845f36bec22302ec02447733bff35aeb2b1b","observation_id":"67f9b7cd-3891-41b3-9aca-46205fd76456","resolution":{"observed_at":"2026-08-10T17:41:07.889803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.893157Z","title":"Hand pose estimation via latent 2.5d heatmap regression","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.893157Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:0b48f504c3d7be632a714b828dbcd0230439613e3243f3a4aad96fcf83f5e729","observation_id":"d7227a3c-5e12-4c33-aa27-e25542e90934","resolution":{"observed_at":"2026-08-10T17:41:07.893157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.897038Z","title":"Quantization and training of neural networks for efficient integer- arithmetic-only inference, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.897038Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:6fc1973d30291a505b48b6ce0af9bc0dff56ea104756e0e95a44101906e23c64","observation_id":"690badb6-e272-46db-b5e5-0a59cee1cb2b","resolution":{"observed_at":"2026-08-10T17:41:07.897038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.900723Z","title":"Latent dirichlet allocation (lda) and topic modeling: models, applications, a survey","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.900723Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:c8069e735f17c03c2316c269cc0f31cafd3ba566e4f7e5d50f12c1bf954876e8","observation_id":"b9439feb-70e1-43c6-9478-df41640a5b50","resolution":{"observed_at":"2026-08-10T17:41:07.900723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.904084Z","title":"Stm: Spatiotemporal and motion encoding for action recogni- tion","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.904084Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:8814b0f104c9f63af068282bb0e5d275fe720ff1cfa814a5d647a531a6d61501","observation_id":"8e9c64f6-8183-4b43-847d-5453f43192ae","resolution":{"observed_at":"2026-08-10T17:41:07.904084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.907706Z","title":"Skeleton aware multi-modal sign language recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.907706Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:f10c4e7ce569e5dbfd9f643920a5725d22725c26c97af3862f5de36ca9bb0d36","observation_id":"241295f9-86f7-4d2d-9030-a68d596a6aee","resolution":{"observed_at":"2026-08-10T17:41:07.907706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.911062Z","title":"Handformer: Hand pose reconstructing from a single rgb image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.911062Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:1edf96e8476ae303798b421b9637222de9b729789f7d28f702e22ccd53d9f632","observation_id":"c89e4022-4c30-41cf-b899-bfa335945028","resolution":{"observed_at":"2026-08-10T17:41:07.911062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.914305Z","title":"Gesture recognition matching based on dynamic skeleton","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.914305Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:5fdba501051c6e63f0ca4da2d87d063b153c741f66d8a869e43e6e64d63300aa","observation_id":"32e10e6c-e39f-429e-a5a3-f9b549c37c67","resolution":{"observed_at":"2026-08-10T17:41:07.914305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.917535Z","title":"Learning effective human pose estimation from inaccurate annotation","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.917535Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:aff42908f418b2d455f74caa6b85626eb7ee842f925913561fb10485d1566e8f","observation_id":"561122b3-8427-416f-981b-3152b49d23dc","resolution":{"observed_at":"2026-08-10T17:41:07.917535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.920619Z","title":"Panoptic studio: A massively multiview system for social motion capture","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.920619Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:ea7bf8e399df8dea3349f153636117687e1d8b2416ca1d429e088e5763ec0cc8","observation_id":"0eabb5dc-1606-448e-91e4-89bac83a64a1","resolution":{"observed_at":"2026-08-10T17:41:07.920619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.923651Z","title":"Total capture: A 3d deformation model for tracking faces, hands, and bodies","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.923651Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:0a972732c490db56c848fa65552d35251bb2bfd2cf4dcc984b8a1272e8241abd","observation_id":"3871108f-7a10-44f0-a34b-2a15a83ef682","resolution":{"observed_at":"2026-08-10T17:41:07.923651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01053","last_updated":"2019-11-20T22:42:52Z","snapshot_observed_at":"2026-08-14T17:49:13.616592Z","submitted_at":"2018-12-03T19:41:16Z","title":"MS-ASL: A Large-Scale Data Set and Benchmark for Understanding American Sign Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01053","snapshot_observed_at":"2026-08-10T17:41:07.926652Z","title":"Ms-asl: A large-scale data set and benchmark for understanding american sign language","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.926652Z"},"links":{"cited_paper":"/paper/1812.01053","citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:98e568763cf10867fe6b88795d05ddee7c5cedbd67fb8d4f55d77f4420fa1227","observation_id":"3fd7d76b-b4e4-48d5-9c60-6e4bdf5bd55d","resolution":{"observed_at":"2026-08-10T17:41:07.926652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.930113Z","title":"Dynamic japanese sign language recognition throw hand pose es- timation using effective feature extraction and classification approach","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.930113Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:13ffcce6e6fbd7dcb959246a8c4e8eef9f42f6e6b8c31c969cd764a9cb25c4e7","observation_id":"d6e7b9c4-a58e-4e96-a918-f186c8772d5c","resolution":{"observed_at":"2026-08-10T17:41:07.930113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.933814Z","title":"Temporal signed gestures segmentation in an image sequence using deep reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.933814Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:e7e808e4621ea4656f83b523abd2d6c7b2bb3c02d2ffa02a106f8d57c1d19a1e","observation_id":"d9d36ed2-cb0b-4aca-b815-ef8a7b2d00d7","resolution":{"observed_at":"2026-08-10T17:41:07.933814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.937294Z","title":"Learning 3d human dynamics from video","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.937294Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:28cd65d9709c66cb59a98edf086871ef8b92400908898895abbb270ae6fc5f3d","observation_id":"ea6a0009-eab8-4475-bed7-aab76d5917d7","resolution":{"observed_at":"2026-08-10T17:41:07.937294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.940725Z","title":"Sign language apprehension using convolution neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.940725Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:8d498f0d2b79af73fe9ccdd8e9d8674d603ab93bc61597d32b95e8ebf9eb125d","observation_id":"2b99860c-0152-43fa-9b25-c62a9db4973c","resolution":{"observed_at":"2026-08-10T17:41:07.940725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.944967Z","title":"Real-time sign language fingerspelling recognition using convolutional neural networks from depth map","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.944967Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:6f54a7a5bf261623de5b4b746937f105e955acc39af8a81aa1c0b1371cc0f77e","observation_id":"3278b4ec-7689-432d-8e8c-c56c4f5f6899","resolution":{"observed_at":"2026-08-10T17:41:07.944967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.948880Z","title":"Black, Krikamol Muandet, and Siyu Tang","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.948880Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:d2d866d11fe7397aba281f52654f244dd512a8ed962695d6a30d25da742a51e6","observation_id":"d9934d98-56d8-41c8-a67f-801b1a49b731","resolution":{"observed_at":"2026-08-10T17:41:07.948880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.952554Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.952554Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:afea017d30301c34a6a7c2f771d512f39538f3be56f7d479fde084c5ab5f2d68","observation_id":"6224f90e-d449-4866-9460-f99b8d082d9d","resolution":{"observed_at":"2026-08-10T17:41:07.952554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.955822Z","title":"Weakly supervised learning with multi-stream cnn-lstm- hmms to discover sequential parallelism in sign language videos","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.955822Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:d6e6ae890b108c575502a3d539aba5c0ccc0ffe2826f47e6afdf521127f07bb2","observation_id":"60c4b1d1-a9c7-401a-8976-c3dfef93465b","resolution":{"observed_at":"2026-08-10T17:41:07.955822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.959232Z","title":"Deep sign: Enabling robust statistical continuous sign language recog- nition via hybrid cnn-hmms","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.959232Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:7cd03cc5dc37de60d0edd57e62c5614e98eca06ca236a1a5bf2ebd40cdaef23f","observation_id":"268087fb-b0a8-4cef-84d2-11b2da86fe1c","resolution":{"observed_at":"2026-08-10T17:41:07.959232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.962451Z","title":"Black, and Kostas Daniilidis","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.962451Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:851aad549458640b748c12aeecfc99af770e5cc9c70ff8ff5e3975f7789fd2c1","observation_id":"54796fc0-a154-4142-9d47-70268dad289c","resolution":{"observed_at":"2026-08-10T17:41:07.962451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.965815Z","title":"Convo- lutional mesh regression for single-image human shape reconstruction","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.965815Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:a5543514474b1b45e62add7c9dbc7aa288f41490d7d75a7aaba2c94c79c0d8b9","observation_id":"9e5e49fc-63f1-4b86-a11a-b047d61fcc33","resolution":{"observed_at":"2026-08-10T17:41:07.965815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.969200Z","title":"Real-time hand gesture detection and classification using convolutional neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.969200Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:7ec35fbda9eeb50e6a0bc3e6c803f3123cd976eeee67bce9eec27223549d49a6","observation_id":"29bd3ab9-3f48-46a5-b19d-a3889f923235","resolution":{"observed_at":"2026-08-10T17:41:07.969200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.972144Z","title":"Motion fused frames: Data level fusion strategy for hand gesture recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.972144Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:903260365b0b397aba4556d0d90e773f92f1b5612809a25460dfd0da27f3a779","observation_id":"3003dc91-c51d-4e97-aa3d-4bb38ab9e312","resolution":{"observed_at":"2026-08-10T17:41:07.972144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.975139Z","title":"Kothadiya, Chintan M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.975139Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:58b5346e7bcb6d470724512a40e32a2e801859d03be8a08fbc8f67c5dadb16e1","observation_id":"5dac9c5c-f1eb-46a5-bc6a-4ae5042036c2","resolution":{"observed_at":"2026-08-10T17:41:07.975139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:41:07.977777Z","title":"Hmdb: a large video database for human motion recognition","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-10T17:41:07.977777Z"},"links":{"citing_paper":"/paper/2501.11992"},"observation_digest":"sha256:4fd59fb6edbbd7d33887ad2f9bc6e5c475992b99d7014f8f2fe10f175f12d1ee","observation_id":"86bf72fc-bdde-40d9-85d6-1cb24b6235fa","resolution":{"observed_at":"2026-08-10T17:41:07.977777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.11992","last_updated":"2025-09-03T10:51:06Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-23T06:04:33.974429Z","submitted_at":"2025-01-21T09:23:22Z","title":"Survey on Hand Gesture Recognition from Visual Input"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":242},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 100 of 242 outbound references and 1 inbound Pith citation observation for arXiv:2501.11992."}