{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2021:FTI3BNBNVCUENZUM2XAG6G3VCR","short_pith_number":"pith:FTI3BNBN","schema_version":"1.0","canonical_sha256":"2cd1b0b42da8a846e68cd5c06f1b75145ca0fc644b385b6f734edf066d999fdc","source":{"kind":"arxiv","id":"2109.08409","version":1},"attestation_state":"computed","paper":{"title":"Expression Snippet Transformer for Robust Video-based Facial Expression Recognition","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Chuanxu Feng, Haoyu Zhang, Wenbin Wang, Yibing Zhan, Yuanyuan Liu, Zhe Chen","submitted_at":"2021-09-17T08:35:24Z","abstract_excerpt":"The recent success of Transformer has provided a new direction to various visual understanding tasks, including video-based facial expression recognition (FER). By modeling visual relations effectively, Transformer has shown its power for describing complicated patterns. However, Transformer still performs unsatisfactorily to notice subtle facial expression movements, because the expression movements of many videos can be too small to extract meaningful spatial-temporal relations and achieve robust performance. To this end, we propose to decompose each video into a series of expression snippet"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2109.08409","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2021-09-17T08:35:24Z","cross_cats_sorted":[],"title_canon_sha256":"9c62d317959ef139f6baec05dfc978f0bee8229f43f1aa2e9082eea295b22b0b","abstract_canon_sha256":"b47fd565521c02e7c5c8e392d1052a5a03bdbb074bb3a2373da2c79266d9e0e0"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T03:15:15.657660Z","signature_b64":"fvCFqarUc4r6yb8GwmMom51+S7jQtkuOiGaj+vWhHuN12IHEtp7LMejoxI5e55ZZX69IGTTDz3+VagXVdO4+DQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"2cd1b0b42da8a846e68cd5c06f1b75145ca0fc644b385b6f734edf066d999fdc","last_reissued_at":"2026-07-05T03:15:15.657220Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T03:15:15.657220Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Expression Snippet Transformer for Robust Video-based Facial Expression Recognition","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Chuanxu Feng, Haoyu Zhang, Wenbin Wang, Yibing Zhan, Yuanyuan Liu, Zhe Chen","submitted_at":"2021-09-17T08:35:24Z","abstract_excerpt":"The recent success of Transformer has provided a new direction to various visual understanding tasks, including video-based facial expression recognition (FER). By modeling visual relations effectively, Transformer has shown its power for describing complicated patterns. However, Transformer still performs unsatisfactorily to notice subtle facial expression movements, because the expression movements of many videos can be too small to extract meaningful spatial-temporal relations and achieve robust performance. To this end, we propose to decompose each video into a series of expression snippet"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2109.08409","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2109.08409/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2109.08409","created_at":"2026-07-05T03:15:15.657283+00:00"},{"alias_kind":"arxiv_version","alias_value":"2109.08409v1","created_at":"2026-07-05T03:15:15.657283+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2109.08409","created_at":"2026-07-05T03:15:15.657283+00:00"},{"alias_kind":"pith_short_12","alias_value":"FTI3BNBNVCUE","created_at":"2026-07-05T03:15:15.657283+00:00"},{"alias_kind":"pith_short_16","alias_value":"FTI3BNBNVCUENZUM","created_at":"2026-07-05T03:15:15.657283+00:00"},{"alias_kind":"pith_short_8","alias_value":"FTI3BNBN","created_at":"2026-07-05T03:15:15.657283+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR","json":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR.json","graph_json":"https://pith.science/api/pith-number/FTI3BNBNVCUENZUM2XAG6G3VCR/graph.json","events_json":"https://pith.science/api/pith-number/FTI3BNBNVCUENZUM2XAG6G3VCR/events.json","paper":"https://pith.science/paper/FTI3BNBN"},"agent_actions":{"view_html":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR","download_json":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR.json","view_paper":"https://pith.science/paper/FTI3BNBN","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2109.08409&json=true","fetch_graph":"https://pith.science/api/pith-number/FTI3BNBNVCUENZUM2XAG6G3VCR/graph.json","fetch_events":"https://pith.science/api/pith-number/FTI3BNBNVCUENZUM2XAG6G3VCR/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR/action/timestamp_anchor","attest_storage":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR/action/storage_attestation","attest_author":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR/action/author_attestation","sign_citation":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR/action/citation_signature","submit_replication":"https://pith.science/pith/FTI3BNBNVCUENZUM2XAG6G3VCR/action/replication_record"}},"created_at":"2026-07-05T03:15:15.657283+00:00","updated_at":"2026-07-05T03:15:15.657283+00:00"}