{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:2F4TM2ASMDAW4RR2C3I37RPQ53","short_pith_number":"pith:2F4TM2AS","schema_version":"1.0","canonical_sha256":"d17936681260c16e463a16d1bfc5f0eeda5a8221effcab69a600a326e04265a2","source":{"kind":"arxiv","id":"2407.01518","version":1},"attestation_state":"computed","paper":{"title":"Towards Multimodal Open-Set Domain Generalization and Adaptation through Self-supervision","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI","cs.LG"],"primary_cat":"cs.CV","authors_text":"Eleni Chatzi, Hao Dong, Olga Fink","submitted_at":"2024-07-01T17:59:09Z","abstract_excerpt":"The task of open-set domain generalization (OSDG) involves recognizing novel classes within unseen domains, which becomes more challenging with multiple modalities as input. Existing works have only addressed unimodal OSDG within the meta-learning framework, without considering multimodal scenarios. In this work, we introduce a novel approach to address Multimodal Open-Set Domain Generalization (MM-OSDG) for the first time, utilizing self-supervision. To this end, we introduce two innovative multimodal self-supervised pretext tasks: Masked Cross-modal Translation and Multimodal Jigsaw Puzzles."},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2407.01518","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CV","submitted_at":"2024-07-01T17:59:09Z","cross_cats_sorted":["cs.AI","cs.LG"],"title_canon_sha256":"1befc41a05bff389d6b9eea59c58aa49b70668a122285de48ff13d848bc45876","abstract_canon_sha256":"f7d857732f3cd39496f1d5f9c85fa947fd69f48e70cd7953a8c0738c094bb3be"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:38:49.041422Z","signature_b64":"GcH45S9SrSFUzCV9Itn+ENKmzUTTC62rIXlu5NUo22ik5x57L3mniue4Ar7zjKFXXZ2xyyesBZjmp7OeQ79MDg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"d17936681260c16e463a16d1bfc5f0eeda5a8221effcab69a600a326e04265a2","last_reissued_at":"2026-07-05T08:38:49.040920Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:38:49.040920Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Towards Multimodal Open-Set Domain Generalization and Adaptation through Self-supervision","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI","cs.LG"],"primary_cat":"cs.CV","authors_text":"Eleni Chatzi, Hao Dong, Olga Fink","submitted_at":"2024-07-01T17:59:09Z","abstract_excerpt":"The task of open-set domain generalization (OSDG) involves recognizing novel classes within unseen domains, which becomes more challenging with multiple modalities as input. Existing works have only addressed unimodal OSDG within the meta-learning framework, without considering multimodal scenarios. In this work, we introduce a novel approach to address Multimodal Open-Set Domain Generalization (MM-OSDG) for the first time, utilizing self-supervision. To this end, we introduce two innovative multimodal self-supervised pretext tasks: Masked Cross-modal Translation and Multimodal Jigsaw Puzzles."},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2407.01518","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2407.01518/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2407.01518","created_at":"2026-07-05T08:38:49.040983+00:00"},{"alias_kind":"arxiv_version","alias_value":"2407.01518v1","created_at":"2026-07-05T08:38:49.040983+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2407.01518","created_at":"2026-07-05T08:38:49.040983+00:00"},{"alias_kind":"pith_short_12","alias_value":"2F4TM2ASMDAW","created_at":"2026-07-05T08:38:49.040983+00:00"},{"alias_kind":"pith_short_16","alias_value":"2F4TM2ASMDAW4RR2","created_at":"2026-07-05T08:38:49.040983+00:00"},{"alias_kind":"pith_short_8","alias_value":"2F4TM2AS","created_at":"2026-07-05T08:38:49.040983+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2507.14935","citing_title":"Open-set Cross Modal Generalization via Multimodal Unified Representation","ref_index":14,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53","json":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53.json","graph_json":"https://pith.science/api/pith-number/2F4TM2ASMDAW4RR2C3I37RPQ53/graph.json","events_json":"https://pith.science/api/pith-number/2F4TM2ASMDAW4RR2C3I37RPQ53/events.json","paper":"https://pith.science/paper/2F4TM2AS"},"agent_actions":{"view_html":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53","download_json":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53.json","view_paper":"https://pith.science/paper/2F4TM2AS","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2407.01518&json=true","fetch_graph":"https://pith.science/api/pith-number/2F4TM2ASMDAW4RR2C3I37RPQ53/graph.json","fetch_events":"https://pith.science/api/pith-number/2F4TM2ASMDAW4RR2C3I37RPQ53/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53/action/timestamp_anchor","attest_storage":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53/action/storage_attestation","attest_author":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53/action/author_attestation","sign_citation":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53/action/citation_signature","submit_replication":"https://pith.science/pith/2F4TM2ASMDAW4RR2C3I37RPQ53/action/replication_record"}},"created_at":"2026-07-05T08:38:49.040983+00:00","updated_at":"2026-07-05T08:38:49.040983+00:00"}