{"as_of":"2026-08-07T22:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:200086735fa82017c1023ba09a3a6abf057c639e6429d17a91f95e921135ea7d","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:46:14.220889Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.04367/citation-record","integrity":"/paper/2506.04367/integrity","json":"/paper/2506.04367/citation-record.json","paper":"/paper/2506.04367"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.103853Z","title":"Bdslw60: A word-level bangla sign language dataset.Multimedia Tools and Applications, pages 1–25, 2025","venue":null,"work_id":"c7961339-22d4-4f4a-8dab-d3528970d05f","year":2025},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.950090Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:6942a0b1d8d573831e5e777953c20ac69c2b011e7e254db89284a515bd0bc3ca","observation_id":"e33f0971-c7fe-4271-8943-6416a54006b8","resolution":{"observed_at":"2026-08-07T10:46:15.107862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02360","last_updated":"2025-03-04T07:34:06Z","snapshot_observed_at":"2026-08-07T17:31:18.195380Z","submitted_at":"2025-03-04T07:34:06Z","title":"BdSLW401: Transformer-Based Word-Level Bangla Sign Language Recognition Using Relative Quantization Encoding (RQE)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02360","snapshot_observed_at":"2026-08-07T10:46:13.954793Z","title":"Bdslw401: Transformer- based word-level bangla sign language recognition using relative quantization encoding (rqe).arXiv preprint arXiv:2503.02360, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.954793Z"},"links":{"cited_paper":"/paper/2503.02360","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:0df677c59742273877c1dbed566e237ab9f5b0b1ee7f3cb6f82497717fc8ddfb","observation_id":"b431a6aa-7285-484f-be08-3c117016e08f","resolution":{"observed_at":"2026-08-07T10:46:13.954793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.092140Z","title":"Deafness and hearing loss","venue":null,"work_id":"c7dc0e13-a1b5-4f9e-a536-78e80077d3db","year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.959268Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:1ffc80b17ecd9ccafd97cf840863c403e515c8741ce5964a2cfc85e22ff198d0","observation_id":"8c99cf81-ae77-4b0e-9c90-2b36f6d37f6e","resolution":{"observed_at":"2026-08-07T10:46:15.096107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.079874Z","title":null,"venue":null,"work_id":"195b3d10-09c3-4bcd-a9bc-3564dcb67d1a","year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.963250Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:22789f39aaba878a4cacddc318a8d947f59c3f030567bd9b18b38369d935fd88","observation_id":"77f5e40e-1469-472b-b305-cf3405b90203","resolution":{"observed_at":"2026-08-07T10:46:15.084143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.067573Z","title":null,"venue":null,"work_id":"b0381211-3f2e-49ef-9f52-8b94dfff3dae","year":2017},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.967516Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:6c567cc516a2a9340cd4d0ca98908bf11f0b4411580774cc63f4826868edbe80","observation_id":"7ade4d37-3e36-4c4e-a8da-b8cbaa7f878d","resolution":{"observed_at":"2026-08-07T10:46:15.072135Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.055198Z","title":"Recent advances on deep learning for sign language recognition.CMES - Computer Modeling in Engineering and Sciences, 139(3):2399–2450, 2024","venue":null,"work_id":"1f0524ab-4255-4c35-9444-285538a2e626","year":2024},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.971757Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:a530446309835b80cdc8fbac3b6c7102511caf726118e73eb2329f100227e572","observation_id":"7e3b7293-4cab-4c45-8d91-5f60927e8c75","resolution":{"observed_at":"2026-08-07T10:46:15.059676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.043335Z","title":"Deeparslr: A novel signer-independent deep learning framework for isolated arabic sign language gestures recognition.IEEE Access, 8:83199–83212, 2020","venue":null,"work_id":"16c6b6b6-fa4f-43fb-8215-b7afb319e14d","year":2020},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.976181Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:76a82532f72a43d09419eda1968b6eb5d2fee6df064cc2ddb1eb38d8c4b98909","observation_id":"03c7e173-0fad-4ab7-9de9-bb9d453db7f1","resolution":{"observed_at":"2026-08-07T10:46:15.047155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.031770Z","title":"Kishore, Teja Maddala, and D","venue":null,"work_id":"e1a68d20-d068-4180-b37b-0186756dcdeb","year":2019},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.980066Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:fa606b1483903db9d0e50aea4a8630f7d5be5b2c98f20607e928b13ff3019edb","observation_id":"c3abcb52-5080-4808-a969-0d4622c3c443","resolution":{"observed_at":"2026-08-07T10:46:15.035504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.019910Z","title":"Using motion history images with 3d convolutional networks in isolated sign language recognition.IEEE Access, 10:18608–18618, 2022","venue":null,"work_id":"18c1b703-1ae6-4714-8a45-b78be6ca0ddc","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.984053Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:f3eb7264ed2e1b1266d50d3a29b0a68043f1506502f24dd5d8d7362c5c67311d","observation_id":"60df4ed5-1e00-4ace-9365-e1954c2ffdc2","resolution":{"observed_at":"2026-08-07T10:46:15.024050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:15.008302Z","title":"Alba-Castro, Laura Docio-Fernandez, and Eduardo Rodriguez-Banga","venue":null,"work_id":"5d3d552f-8ac0-4dbf-b706-1f6171b29ee9","year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.987974Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:2e2694c88783f4e3ad23e9b07b9acc57ba889f26763c5a01344d4b0d764d4bb7","observation_id":"ea06b360-6d0f-4e67-b696-582788c4e273","resolution":{"observed_at":"2026-08-07T10:46:15.012237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.996599Z","title":"One model is not enough: Ensembles for isolated sign language recognition.Sensors, 22(13), 2022","venue":null,"work_id":"8262566d-c107-40d0-a0ac-a8cefea6377b","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.991863Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:e87123a1537d91a59da2084e3c0478a503951e9f3b2cf710b755ce60a30a9a0e","observation_id":"2eb23036-2931-4c2f-b41a-77ac86f882dc","resolution":{"observed_at":"2026-08-07T10:46:15.000555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.984222Z","title":null,"venue":null,"work_id":"e3e17ff4-8fe6-41c0-b10f-59ba49554afd","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.995647Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:a20a26da761d39151c139c3a37460d4fb1baa5036c059b536cdc7d0a9cc01459","observation_id":"79940208-7a2f-4463-ad37-805dfb0eb5d4","resolution":{"observed_at":"2026-08-07T10:46:14.988626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17429","last_updated":"2023-10-26T14:37:01Z","snapshot_observed_at":"2026-07-06T16:39:00.553251Z","submitted_at":"2023-10-26T14:37:01Z","title":"LSA64: An Argentinian Sign Language Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17429","snapshot_observed_at":"2026-08-07T10:46:13.999634Z","title":"Lsa64: An argentinian sign language dataset.arXiv preprint arXiv:2310.17429, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:13.999634Z"},"links":{"cited_paper":"/paper/2310.17429","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:7c75c7a62696f6b39bc783080cb6ebaea36babad297866719c37265a05b65d12","observation_id":"10aecf81-2458-4619-9eb1-7d31d47a84d5","resolution":{"observed_at":"2026-08-07T10:46:13.999634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.972374Z","title":"Best: Bert pre-training for sign language recognition with coupling tokenization.Proceedings of the AAAI conference on artificial intelligence, 37(3):3597–3605, 2023","venue":null,"work_id":"3adc2f20-613a-41ee-9837-c318b2bee6d8","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.003553Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:4da0f53eaf0a5d92766f6fe42b161f36c7fc2fd02ca321c08e603cc71645baf2","observation_id":"6e5ded83-e30a-4a37-8182-defc740442a1","resolution":{"observed_at":"2026-08-07T10:46:14.976338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.960778Z","title":"Deep learning for computer vision: A brief review.Intell","venue":null,"work_id":"46dbfde8-b4cc-44db-aebb-68a5a6bda619","year":2018},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.007456Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:88463658edec7093b6e9878b62209c99a94c8568ab870964f9f2e27703f2e1b9","observation_id":"94278745-79ba-4801-837d-bc227de0ef28","resolution":{"observed_at":"2026-08-07T10:46:14.964607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.949036Z","title":"Asl-3dcnn: American sign language recognition technique using 3-d convolutional neural networks.Multimedia Tools and Applications, 80(17):26319–26331, 2021","venue":null,"work_id":"e991f06a-04d3-4657-83f0-502a7fcb7fa1","year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.011224Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:0424f55bc79aa748d4549a0624c3494d2d4cb260f5c68b75acd12f53359a5733","observation_id":"fbbdaa48-c0a0-4875-a3d1-dfb41e7a88e8","resolution":{"observed_at":"2026-08-07T10:46:14.952935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.937595Z","title":"3d convolutional neural networks for dynamic sign language recognition.The Computer Journal, 61(11):1724–1736, 2018","venue":null,"work_id":"1e98aa0c-bbce-46c8-b85c-c7881f5369e9","year":2018},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.014908Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:d32ede4d06047c07ed3b8fa6949a7e75af7d22f25db90e39d54da137b27f8443","observation_id":"aa296fdd-73bc-4cd6-88cb-681c81e29358","resolution":{"observed_at":"2026-08-07T10:46:14.941446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07693","last_updated":"2023-02-16T07:57:08Z","snapshot_observed_at":"2026-07-06T14:52:07.793181Z","submitted_at":"2023-02-15T14:36:18Z","title":"Fine-tuning of sign language recognition models: a technical report","version":2},"cited_work":{"arxiv_id":"2302.07693","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.07693","snapshot_observed_at":"2026-08-07T10:46:14.441334Z","title":"Fine-tuning of sign language recognition models: a technical report","venue":"cs.CV","work_id":"83cf51cf-78ba-4514-8421-6d37037a680b","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.018602Z"},"links":{"cited_paper":"/paper/2302.07693","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:1517ffc3c23676302bf1ee44502a3d716b9255d9bf41d555a1858a7340f77b66","observation_id":"be473e3c-a114-45b1-9370-c1e8a6cde401","resolution":{"observed_at":"2026-08-07T10:46:14.445497Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02450","last_updated":"2023-09-02T03:00:03Z","snapshot_observed_at":"2026-08-05T20:28:31.239785Z","submitted_at":"2023-09-02T03:00:03Z","title":"Self-Supervised Video Transformers for Isolated Sign Language Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02450","snapshot_observed_at":"2026-08-07T10:46:14.022472Z","title":"Self- supervised video transformers for isolated sign language recognition.arXiv preprint arXiv:2309.02450, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.022472Z"},"links":{"cited_paper":"/paper/2309.02450","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:d49e2f8094dd9e3e6762e13a869bc044989e92aaa925ac8bf29ec853e113414c","observation_id":"b2f52916-6af0-415b-a48f-72c74f5c2bc6","resolution":{"observed_at":"2026-08-07T10:46:14.022472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.925893Z","title":"Full transformer network with masking future for word-level sign language recognition.Neurocomputing, 500:115–123, 2022","venue":null,"work_id":"195f2080-273a-407e-8b36-72df3907d950","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.026643Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:7e38a987e6b5c56d19cbb6112eb9d1071cb7c0cbb080a4de06c09989dfa5a424","observation_id":"757e0c87-c706-414e-b93f-69008b7e816d","resolution":{"observed_at":"2026-08-07T10:46:14.929884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.914400Z","title":"Sign language recognition from digital videos using feature pyramid network with detection transformer.Multimedia Tools and Applications, 82(14):21673–21685, 2023","venue":null,"work_id":"1c9fbb03-662c-49fa-88d1-ddc942e0f33e","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.030616Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:1911df3e0808cef7a80892fffc560d5e2370738e41849ef83f9f2907800fc5a0","observation_id":"94d905c8-bdcb-4d94-962a-b026ec3832bf","resolution":{"observed_at":"2026-08-07T10:46:14.918251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.902516Z","title":null,"venue":null,"work_id":"835ddf65-bcae-45d7-a1a2-00c8f26b4703","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.034221Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:0f0bdc796983f6725c6c6b786548b85ad23a50d1806dbba5cb1d0761083cadfd","observation_id":"147de32e-3a4b-4351-bfdb-9380fff5a1af","resolution":{"observed_at":"2026-08-07T10:46:14.906368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.890429Z","title":"Transfer learning in sign language.2007 IEEE conference on computer vision and pattern recognition, pages 1–8, 2007","venue":null,"work_id":"cc0b9d06-6d4c-450f-888a-7dba64b50d9b","year":2007},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.038040Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:1ddef7fc054fa92767168c669b45f4e92cbed8ef46091633fc8544e043b6055b","observation_id":"3419564f-6da1-4bf8-bf8f-10d5cdb4c74a","resolution":{"observed_at":"2026-08-07T10:46:14.894337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.878771Z","title":"Samir Imtiaz, Nieb Hasan Neom, Nazmul Siddique, and Hui Wang","venue":null,"work_id":"1cf9a4a6-2874-4c52-b648-8abb52da9f72","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.041864Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:9f82d31dad17267fcf79e8ff974d12b72b57650c6fe0e927a3ea1c2792402bab","observation_id":"b04bdb5b-cce9-4f2f-a8be-311d3a21d8b3","resolution":{"observed_at":"2026-08-07T10:46:14.882648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.866667Z","title":"Bird, Anikó Ekárt, and Diego R","venue":null,"work_id":"088fe454-a92f-4f19-8a5c-776cb9f39159","year":2020},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.045506Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:27dfb7589cb3e58047a5967c05af4055ff6284cd7573dee85c335eb913c80ca6","observation_id":"66335185-1c61-48d1-b7a7-03a96e7e9976","resolution":{"observed_at":"2026-08-07T10:46:14.871073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.02144","last_updated":"2020-06-03T10:13:29Z","snapshot_observed_at":"2026-07-06T09:25:38.947018Z","submitted_at":"2020-06-03T10:13:29Z","title":"Transfer Learning for British Sign Language Modelling","version":1},"cited_work":{"arxiv_id":"2006.02144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.02144","snapshot_observed_at":"2026-08-07T10:46:14.411382Z","title":"Transfer Learning for British Sign Language Modelling","venue":"cs.CL","work_id":"1910380d-b9ff-4bac-b9bb-3b3be15a9c23","year":2020},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.049403Z"},"links":{"cited_paper":"/paper/2006.02144","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:f6b8f90ab372dfd7fb3850e998b421dbcffcfa3692228d234ddcfe3469eb17b7","observation_id":"3042e0cf-885b-4c4d-aedc-78850db79b64","resolution":{"observed_at":"2026-08-07T10:46:14.415849Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.855069Z","title":"Alharthi and Salha M","venue":null,"work_id":"8ceb5c7b-aced-4e62-8bf1-b9198a4ca5ef","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.053486Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:e2eb570eac39ff62ac054191d88ea806de9571f7956e8b16a417b82cb7be9f8f","observation_id":"bfe0694b-1827-4228-84ed-293b9cae2cf3","resolution":{"observed_at":"2026-08-07T10:46:14.858768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.842496Z","title":"Multi-phase fine-tuning: A new fine-tuning approach for sign language recognition.KI - Künstliche Intelligenz, 36, 02 2022","venue":null,"work_id":"1c88e936-48b0-4641-a417-902b1cb3b766","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.057088Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:e6284d29b29881e49089b13a40264a4a8d23965d912e15644dc7450dc50e2413","observation_id":"d8273994-eb6f-44ac-9f94-2061442cba5a","resolution":{"observed_at":"2026-08-07T10:46:14.847389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.830256Z","title":null,"venue":null,"work_id":"3f184a57-9e5c-438b-aaf8-b170289c85e3","year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.061057Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:8c9e602bd95074e0ac3f4c8423c661d3068611db4ad80b35f12bdda3471c2689","observation_id":"a0c87314-5209-4373-93f5-ea9520aeeab0","resolution":{"observed_at":"2026-08-07T10:46:14.834674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.818774Z","title":null,"venue":null,"work_id":"0db4b92b-e225-4aa2-9395-403eab4e5ce1","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.064719Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:1cdc173da946811fc0d506bc34dd42091c00ddf4516118db44be110c0478aa5e","observation_id":"09688886-e0e6-46d2-8869-3c12ae5c7614","resolution":{"observed_at":"2026-08-07T10:46:14.822486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.807045Z","title":"Borno-net: A real-time bengali sign-character detection and sentence generation system using quantized yolov4-tiny and lstms.Applied Sciences, 13(9), 2023","venue":null,"work_id":"7f1c1570-a61c-447d-80c3-1b4e7e8717b1","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.068436Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:03c2384111da20ecd53915f225f7efa5fea64f269500dea2bf0d867c78c0e4c1","observation_id":"e8a5a4df-238f-41b8-b15a-9ee3dc381a3d","resolution":{"observed_at":"2026-08-07T10:46:14.811040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.795313Z","title":null,"venue":null,"work_id":"1d35a997-51f3-4e24-b181-b76456853879","year":2025},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.072192Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:7f57550307258509c9ba6ed007c28f179d555265841961c36e290c0a99258ea5","observation_id":"bf3defab-0e68-437c-bfd4-23a85e1f4dcd","resolution":{"observed_at":"2026-08-07T10:46:14.799022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.782587Z","title":"Computer vision-based hybrid efficient convolution for isolated dynamic sign language recognition.Neural Computing and Applications, 36(32):19951–19966, 2024","venue":null,"work_id":"2c388166-f09e-4be9-8a16-e3d8c5020e8c","year":2024},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.075881Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:c6208b51dc67ad3b5c49c3ab8cc0f459242caa95d56dcb181d0cdd44f52d4ee9","observation_id":"594a77d3-0a21-4ef0-bcf2-b53e39ba97b3","resolution":{"observed_at":"2026-08-07T10:46:14.787307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03328","last_updated":"2022-04-07T09:49:12Z","snapshot_observed_at":"2026-08-04T09:50:52.882470Z","submitted_at":"2022-04-07T09:49:12Z","title":"A Comprehensive Review of Sign Language Recognition: Different Types, Modalities, and Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03328","snapshot_observed_at":"2026-08-07T10:46:14.079468Z","title":"Madhiarasan and Partha Pratim Roy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.079468Z"},"links":{"cited_paper":"/paper/2204.03328","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:494afebf5d321ef5b73e63c341e4966cb8e103503cfffa8b14e0b6a6a7eedefc","observation_id":"134b9b0c-64fe-4aba-ba63-9cc19ed72dd2","resolution":{"observed_at":"2026-08-07T10:46:14.079468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.770669Z","title":"A review of hand gesture and sign language recognition techniques.International Journal of Machine Learning and Cybernetics, 10, 01 2019","venue":null,"work_id":"2504f81b-6632-4e11-83a9-8992ac6529ab","year":2019},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.083525Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:067959e7e75c83902b5355624408d6c2496a9dc60848916c673b838475415347","observation_id":"62e1cf6f-3ee2-4a31-be5c-9ec0fbee225f","resolution":{"observed_at":"2026-08-07T10:46:14.774683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.758302Z","title":"Recognition of symbolic gestures using depth information.Advances in Human-Computer Interaction, 2018(1):1069823, 2018","venue":null,"work_id":"4c462c85-a1c0-4bf8-a519-1f235d7df3bb","year":2018},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.087203Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:3db9c7713b2d04fca80af35a23f5f9f91f8ed131212218e3a926156bf8a30932","observation_id":"212c93fe-3123-4fed-ae50-9ed936671fb3","resolution":{"observed_at":"2026-08-07T10:46:14.762770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.746096Z","title":"AL-Rousan, K","venue":null,"work_id":"02adac8a-33df-4e13-a4f0-09c2c8994875","year":2009},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.091057Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:678fc27b9b9331434bdd30079351b59ae86deb6ae1dc1692c60e848856fd1a32","observation_id":"161b3ea1-f9a7-427e-ab20-972defe33632","resolution":{"observed_at":"2026-08-07T10:46:14.750504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.733850Z","title":"Signer independent isolated italian sign recognition based on hidden markov models.Formal Pattern Analysis & Applications, 18, 10 2014","venue":null,"work_id":"d3e8c5bd-ea58-4f67-af73-7071aa9839b5","year":2014},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.094765Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:2947c974e2b5cb2ca18e6c4e583bfb38eedfac1f95fd6f57011bb09c26beba59","observation_id":"04b1569c-b18b-4357-a10d-c5fdc883c3a4","resolution":{"observed_at":"2026-08-07T10:46:14.738287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.722349Z","title":null,"venue":null,"work_id":"816c082b-3dbe-4ff4-8a79-6a5cf1c58f0d","year":2019},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.098474Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:6dc6671d8bdbff58402fa9407eb5ee09f842179122f2550a5b707ddcebaaf29b","observation_id":"2ace81aa-9530-45b7-89a8-4c19d5fa7b15","resolution":{"observed_at":"2026-08-07T10:46:14.726068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.710878Z","title":null,"venue":null,"work_id":"04717de7-a559-452c-9d72-5bc2ab262974","year":2018},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.101946Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:99ffb0970cf74de144fe99f08d878176b3c39ba65c5e4b685e305a5cca92da48","observation_id":"f634373f-6c5b-4a93-a9d5-1909c79bba53","resolution":{"observed_at":"2026-08-07T10:46:14.714491Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.698760Z","title":"Video-based isolated hand sign language recognition using a deep cascaded model.Multimedia Tools and Applications, 79, 08 2020","venue":null,"work_id":"aa1fb4da-228e-40dd-9f79-d79a94ea4fe6","year":2020},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.105792Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:8b5595eb86118fb73185cee9e09aade91beaffe834004510da17a4d4f1f93fe8","observation_id":"474e6193-8e04-494b-8ccb-c460e33ca71f","resolution":{"observed_at":"2026-08-07T10:46:14.702750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.686839Z","title":"Hand pose aware multimodal isolated sign language recognition.Multimedia Tools and Applications, 80(1):127–163, 2021","venue":null,"work_id":"4c3eed4c-7ea4-4127-8498-def637fa02ac","year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.109417Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:809cde5040041a4947e32b7b184cf99f5f6e68ca29b6326a6653f4d983ce2313","observation_id":"f5833c29-e78c-4f16-ad33-627a678099b8","resolution":{"observed_at":"2026-08-07T10:46:14.690889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.675107Z","title":"Al Mehedi Hasan, Koki Hirooka, Kota Suzuki, Hyoun-Sup Lee, and Si-Woong Jang","venue":null,"work_id":"3d040150-a049-4abe-97c3-694bf7051a4b","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.113259Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:28da426d229b910e73687e7f5750c79328ede101399008ac6b78c47598bd0839","observation_id":"de7ef3fe-2d7e-4517-92bc-a61d0e8b1398","resolution":{"observed_at":"2026-08-07T10:46:14.679126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.663149Z","title":"Johir Raihan, Mainul Islam Labib, Abdullah Al Jaid Jim, Jun Jiat Tiang, Uzzal Biswas, and Abdullah-Al Nahid","venue":null,"work_id":"17c9fa94-d88d-4f66-a114-3ffa54dd2e0b","year":2024},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.116754Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:4725a983daada16b4b2113b96e040fa72e77b7a369f365ecca9bd0c6a925ef49","observation_id":"5d300faa-dcd0-46a1-87b7-021a8236f7d1","resolution":{"observed_at":"2026-08-07T10:46:14.667106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.651014Z","title":"Sign language recognition with transformer networks.Proceedings of the Twelfth Language Resources and Evaluation Conference, pages 6018–6024, 2020","venue":null,"work_id":"2974cd25-2282-410a-aae0-16fb56aa506d","year":2020},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.120664Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:f8e33cbccdd752d6c25ce33afb2a2e4f53e1ea9e3fdb83e86bbd9fb801793a69","observation_id":"4fcbd09b-1759-4398-9cd8-5a44c4ec91cb","resolution":{"observed_at":"2026-08-07T10:46:14.655267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.638587Z","title":null,"venue":null,"work_id":"fb984ae6-9c8c-47cb-ba6f-e3a46e7ec284","year":2024},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.124384Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:990ed5bfdab1bef55dd59899aac9a48900998b7a952b46cd943b26de51f4e4cb","observation_id":"3e45c543-d358-4047-8d89-ceccd0d3e9ea","resolution":{"observed_at":"2026-08-07T10:46:14.642542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.626225Z","title":"Bdsl47: A complete depth-based bangla sign alphabet and digit dataset.Data in Brief, 51:109799, 2023","venue":null,"work_id":"e808ba5b-7349-4b85-a3f2-b32c20887e0b","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.128081Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:c7413790cc95234477c0802b608861327b1e7679dec78fa4f98b32af23a26a09","observation_id":"ba49be35-7ce3-4022-b596-6cb1bda0c0eb","resolution":{"observed_at":"2026-08-07T10:46:14.630351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.614133Z","title":"Efficient 3d cnns with knowledge transfer for sign language recognition","venue":null,"work_id":"1bdefaf7-4df3-4bdc-af41-00b1a7c27e05","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.131762Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:64a191bb356601a931a374e4c5871fff30cae9f168d2113f26d0dc1255e74f96","observation_id":"72578ddb-c1ee-45d9-830b-39a4b5599adc","resolution":{"observed_at":"2026-08-07T10:46:14.618184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.602179Z","title":"Bangla sign alphabet recognition with zero-shot and transfer learning.Pattern Recognition Letters, 150:84–93, 2021","venue":null,"work_id":"de1aefdf-3a2a-462b-b718-26f16c00065a","year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.135357Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:8cadfa08f3405b8cbb36b29e7cf5a2e30254f8f0838a2bf22947fb32bbe09330","observation_id":"f0fda0be-2d26-40d9-a7ca-9d0b4467524b","resolution":{"observed_at":"2026-08-07T10:46:14.605935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.588228Z","title":null,"venue":null,"work_id":"447f7da4-27f7-4396-8cda-48989d989387","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.139906Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:afc98270eae6c69c3bb4049cd64c01dcf005d25633161902b5b5c564ba23cca7","observation_id":"32c6b625-424c-4072-8c59-ca38408439eb","resolution":{"observed_at":"2026-08-07T10:46:14.593018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.575390Z","title":"A short video classification framework based on cross-modal fusion.Sensors, 23(20), 2023","venue":null,"work_id":"3fd64d38-6a2f-4b1e-ba9f-a667e4780642","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.143748Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:668211f79f893fc9ca42c2b79150a1664baa0f4b249c58d2773a48808f095d60","observation_id":"a7fa161f-a5c7-48de-8450-8b3e944eb862","resolution":{"observed_at":"2026-08-07T10:46:14.579462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.561883Z","title":"Dodge, and Mohammad H","venue":null,"work_id":"557d803c-cae4-4e10-b8b9-e667b40fed7e","year":2024},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.147330Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:5ab81dedac357cc987960ef395c1048a9c95c3930b6f9a65242e31fd9d5f34f3","observation_id":"6f8689b1-5379-45b8-bca7-59b92da51f7f","resolution":{"observed_at":"2026-08-07T10:46:14.566645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12602","last_updated":"2022-10-18T09:15:42Z","snapshot_observed_at":"2026-08-05T00:36:47.095250Z","submitted_at":"2022-03-23T17:55:10Z","title":"VideoMAE: Masked Autoencoders are Data-Efficient Learners for Self-Supervised Video Pre-Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12602","snapshot_observed_at":"2026-08-07T10:46:14.151441Z","title":"Videomae: Masked autoencoders are data-efficient learners for self-supervised video pre-training.arXiv preprint arXiv:2203.12602, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.151441Z"},"links":{"cited_paper":"/paper/2203.12602","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:0b1411e3b9edf831b856321dc31a823fa03f5ff58cce7ea090e60dfa271259ea","observation_id":"1ee0adec-e107-440f-9b09-0ad25428836c","resolution":{"observed_at":"2026-08-07T10:46:14.151441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15691","last_updated":"2021-11-01T12:55:56Z","snapshot_observed_at":"2026-08-06T03:32:00.098200Z","submitted_at":"2021-03-29T15:27:17Z","title":"ViViT: A Video Vision Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15691","snapshot_observed_at":"2026-08-07T10:46:14.155465Z","title":"Vivit: A video vision transformer.arXiv preprint arXiv:2103.15691, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.155465Z"},"links":{"cited_paper":"/paper/2103.15691","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:8fbc7354e75469fa4fe4c7095400d4e4adc7c7d7b77be3d668b933cf0e87bc39","observation_id":"05e657ca-e725-432d-850e-cdb03a59b95c","resolution":{"observed_at":"2026-08-07T10:46:14.155465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05095","last_updated":"2021-06-09T14:48:13Z","snapshot_observed_at":"2026-08-07T10:40:57.763739Z","submitted_at":"2021-02-09T19:49:33Z","title":"Is Space-Time Attention All You Need for Video Understanding?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05095","snapshot_observed_at":"2026-08-07T10:46:14.159369Z","title":"Is space-time attention all you need for video understanding? arXiv preprint arXiv:2102.05095, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.159369Z"},"links":{"cited_paper":"/paper/2102.05095","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:ef10dc7b9d3b063cdc910fe9b355bd28350b4749eddd5779500071f95a5b2675","observation_id":"eeb68259-9d9e-44d4-b995-f92cc6f0856e","resolution":{"observed_at":"2026-08-07T10:46:14.159369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-07-06T05:43:22.028213Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T10:46:14.163962Z","title":"The kinetics human action video dataset.arXiv preprint arXiv:1705.06950, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.163962Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:53a05b5ddf43d1d62443f37d126ce0ef4ea67aa3a13645aa26fb92b1a7a5b051","observation_id":"c5aaaeed-ae4f-49e7-bba3-991167248578","resolution":{"observed_at":"2026-08-07T10:46:14.163962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.06377","last_updated":"2021-12-19T19:23:25Z","snapshot_observed_at":"2026-07-31T02:35:46.853381Z","submitted_at":"2021-11-11T18:46:40Z","title":"Masked Autoencoders Are Scalable Vision Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.06377","snapshot_observed_at":"2026-08-07T10:46:14.167929Z","title":"Masked autoencoders are scalable vision learners.arXiv preprint arXiv:2111.06377, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.167929Z"},"links":{"cited_paper":"/paper/2111.06377","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:297b74944fea43b0ffd05d04dd364f564cb012a821b013f8e8f654850d0a4146","observation_id":"f7aee8f3-d2cf-4ec4-b254-e0c133957bd9","resolution":{"observed_at":"2026-08-07T10:46:14.167929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.549591Z","title":"Mgmae: Motion guided masking for video masked autoencoding.Proceedings of the IEEE/CVF International Conference on Computer Vision, pages 13493–13504, 2023","venue":null,"work_id":"aad44bd4-0bd0-4bcc-83b9-eb3a87147282","year":2023},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.171962Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:21e627b170cc1f281706c47ccc41003d34201aba62bcfd10990e1c89ff434411","observation_id":"76d1b2cf-460f-4ad9-8549-aea13fe05fcf","resolution":{"observed_at":"2026-08-07T10:46:14.553760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T10:46:14.175705Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2021","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.175705Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:0a8fd8fc87fdb5cb283f62b68a08e1627280e21d7201c36af41f573e85f05fbf","observation_id":"716dc546-097f-46cd-9324-14d8b1dbd87a","resolution":{"observed_at":"2026-08-07T10:46:14.175705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.537317Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":"d04a9d91-8b0c-4a91-a2e5-0699da0a99fd","year":2017},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.179945Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:1a37fb389e79e48906ffa24e41b1f61d3908a2ab455d2650ae414f0ddcfc2fc4","observation_id":"ed7d7f5e-3264-4c7e-8bff-97a4cf5b661f","resolution":{"observed_at":"2026-08-07T10:46:14.541430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.525070Z","title":"X3d: Expanding architectures for efficient video recognition.Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), June 2020","venue":null,"work_id":"d4759ed5-4442-48ed-99b0-69f82ccb9b0f","year":2020},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.183904Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:4de3a86aa69a7899d45073d18c445fb958c4a7191f80c972554852ee2781d152","observation_id":"ba8ebdf3-f4bb-42dd-ae6f-f84985e52f8a","resolution":{"observed_at":"2026-08-07T10:46:14.529175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02707","last_updated":"2019-05-17T14:17:25Z","snapshot_observed_at":"2026-08-06T20:46:43.894917Z","submitted_at":"2018-12-06T18:42:25Z","title":"Video Action Transformer Network","version":2},"cited_work":{"arxiv_id":"1812.02707","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.02707","snapshot_observed_at":"2026-08-07T10:46:14.310470Z","title":"Video Action Transformer Network","venue":"cs.CV","work_id":"e10d8ae9-f238-4d5f-b4db-01621439ffba","year":2018},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.188309Z"},"links":{"cited_paper":"/paper/1812.02707","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:71f6b3ad6c2290b094380954daf1d217d01b6a1b6acdce82a9effb62b0b2e610","observation_id":"adddd687-b1f7-4c86-ae40-6ebb4e09e037","resolution":{"observed_at":"2026-08-07T10:46:14.314641Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.07971","last_updated":"2018-04-13T06:40:44Z","snapshot_observed_at":"2026-07-06T06:10:36.816766Z","submitted_at":"2017-11-21T18:51:16Z","title":"Non-local Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.07971","snapshot_observed_at":"2026-08-07T10:46:14.192305Z","title":"Non-local neural networks.arXiv preprint arXiv:1711.07971, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.192305Z"},"links":{"cited_paper":"/paper/1711.07971","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:24dfea6cb5a61272a0fa5b8beb366f85ea6f1596bf00a31eb1a31f5305f4adc2","observation_id":"361151a5-2838-40dc-942b-795617add493","resolution":{"observed_at":"2026-08-07T10:46:14.192305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05038","last_updated":"2019-04-17T19:05:30Z","snapshot_observed_at":"2026-07-06T07:20:46.902118Z","submitted_at":"2018-12-12T17:13:55Z","title":"Long-Term Feature Banks for Detailed Video Understanding","version":2},"cited_work":{"arxiv_id":"1812.05038","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.05038","snapshot_observed_at":"2026-08-07T10:46:14.278819Z","title":"Long-Term Feature Banks for Detailed Video Understanding","venue":"cs.CV","work_id":"7ce4904c-f379-4945-864e-dd352cc50be1","year":2018},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.196305Z"},"links":{"cited_paper":"/paper/1812.05038","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:eeeebb9209db3c032bc466d73515dc675e69ddd047408dd17b4f297716f21cab","observation_id":"31447697-db28-4885-8c94-cf0bfcc2a245","resolution":{"observed_at":"2026-08-07T10:46:14.284465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.200212Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.200212Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:ae05013a4b7d57d530280e01f5d653c93217b750b431ac70466a193c4a4d1d70","observation_id":"9c8343d1-4e53-4aa5-be89-7543b4b1dd32","resolution":{"observed_at":"2026-08-07T10:46:14.200212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.504887Z","title":"Fine-tuning cnn image retrieval with no human annotation","venue":null,"work_id":"23ada45d-3a77-40aa-8479-2345c977e2cc","year":2019},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.204164Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:88f760b2c28a56923e7c2475f2cfa6ceea9017ae22af83baeb7e782787f0daae","observation_id":"3b3c42d7-b855-44f9-aab7-069277fde163","resolution":{"observed_at":"2026-08-07T10:46:14.508923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.491073Z","title":"Arabic sign language letters recognition using vision transformer","venue":null,"work_id":"66083a21-7ae6-4401-8f83-a72269100c44","year":2024},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.208381Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:ada267b6d875aab01faaf835ed75a3d56ad8bc8ebbc022c9b8ee2338bba2f55c","observation_id":"98807a74-b1e7-47ed-9fca-508996c6b74d","resolution":{"observed_at":"2026-08-07T10:46:14.495709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.11006","last_updated":"2020-01-21T00:24:44Z","snapshot_observed_at":"2026-07-06T08:31:53.564442Z","submitted_at":"2019-10-24T10:04:29Z","title":"Word-level Deep Sign Language Recognition from Video: A New Large-scale Dataset and Methods Comparison","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.11006","snapshot_observed_at":"2026-08-07T10:46:14.212847Z","title":"Word-level deep sign language recognition from video: A new large-scale dataset and methods comparison.arXiv preprint arXiv:1910.11006, 2020","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.212847Z"},"links":{"cited_paper":"/paper/1910.11006","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:0653f44a239439889f66c2e2e32801ae70f1956325683eac225f654a54340a8c","observation_id":"7f92aad8-0e70-491d-96e9-88acc63313cd","resolution":{"observed_at":"2026-08-07T10:46:14.212847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:46:14.478579Z","title":"Bencherif, Mansour Alsulaiman, Ghulam Muhammad, Mohamed Amine Mekhtiche, Wadood Abdul, Yousef A","venue":null,"work_id":"79d13bda-19ce-41ec-9ecb-f3406539df74","year":2022},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.217115Z"},"links":{"citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:47280c158cabcfe9f3da1ffdedb01041becc28de081b7bf5c5e4cf245d9f0ca6","observation_id":"86d94bf3-f335-4e5e-8a83-eb111f3eecb4","resolution":{"observed_at":"2026-08-07T10:46:14.482796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14224","last_updated":"2024-09-27T12:31:24Z","snapshot_observed_at":"2026-07-06T18:48:58.038753Z","submitted_at":"2024-07-19T11:48:36Z","title":"Hierarchical Windowed Graph Attention Network and a Large Scale Dataset for Isolated Indian Sign Language Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14224","snapshot_observed_at":"2026-08-07T10:46:14.220889Z","title":"Hierarchical windowed graph attention network and a large scale dataset for isolated indian sign language recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T10:46:14.220889Z"},"links":{"cited_paper":"/paper/2407.14224","citing_paper":"/paper/2506.04367"},"observation_digest":"sha256:d3ba6d0e5b6ec35a856e4328b3e799771d879284ae3e9ba2321f0fc0c34455ac","observation_id":"2a77345c-4721-4925-b2f8-5b4b9afde465","resolution":{"observed_at":"2026-08-07T10:46:14.220889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04367","last_updated":"2025-06-04T18:29:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:41:26.672583Z","submitted_at":"2025-06-04T18:29:32Z","title":"Fine-Tuning Video Transformers for Word-Level Bangla Sign Language: A Comparative Analysis for Classification Tasks"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":4,"verified_fuzzy":41},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2506.04367."}