{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2023:UROY7UW2DJB2ERM3L6SUGV5HSW","short_pith_number":"pith:UROY7UW2","schema_version":"1.0","canonical_sha256":"a45d8fd2da1a43a2459b5fa54357a795a3e8318931ca77fc0cebc39c996eced5","source":{"kind":"arxiv","id":"2401.00421","version":1},"attestation_state":"computed","paper":{"title":"From Text to Pixels: A Context-Aware Semantic Synergy Solution for Infrared and Visible Image Fusion","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Jinyuan Liu, Long Ma, Risheng Liu, Xin Fan, Xingyuan Li, Yang Zou, Zhiying Jiang","submitted_at":"2023-12-31T08:13:47Z","abstract_excerpt":"With the rapid progression of deep learning technologies, multi-modality image fusion has become increasingly prevalent in object detection tasks. Despite its popularity, the inherent disparities in how different sources depict scene content make fusion a challenging problem. Current fusion methodologies identify shared characteristics between the two modalities and integrate them within this shared domain using either iterative optimization or deep learning architectures, which often neglect the intricate semantic relationships between modalities, resulting in a superficial understanding of i"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2401.00421","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2023-12-31T08:13:47Z","cross_cats_sorted":[],"title_canon_sha256":"74baa019d5cccb760a42247640e6f7957519139cb9287c034963b2b3a1a69622","abstract_canon_sha256":"027e1a9e510cae7ce079ed56ab6f0cb4a8fb6a03042b1d53ce87f20f8354132b"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T07:29:18.267185Z","signature_b64":"CI6/95bNNyPOZPnaduCey6IrUSQbHkxtnGS2MFdwMSyjbvDPQlU5xFtoYwNle+gtGEzee2rVRZW3tZGTmYZRAQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"a45d8fd2da1a43a2459b5fa54357a795a3e8318931ca77fc0cebc39c996eced5","last_reissued_at":"2026-07-05T07:29:18.266623Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T07:29:18.266623Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"From Text to Pixels: A Context-Aware Semantic Synergy Solution for Infrared and Visible Image Fusion","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Jinyuan Liu, Long Ma, Risheng Liu, Xin Fan, Xingyuan Li, Yang Zou, Zhiying Jiang","submitted_at":"2023-12-31T08:13:47Z","abstract_excerpt":"With the rapid progression of deep learning technologies, multi-modality image fusion has become increasingly prevalent in object detection tasks. Despite its popularity, the inherent disparities in how different sources depict scene content make fusion a challenging problem. Current fusion methodologies identify shared characteristics between the two modalities and integrate them within this shared domain using either iterative optimization or deep learning architectures, which often neglect the intricate semantic relationships between modalities, resulting in a superficial understanding of i"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2401.00421","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2401.00421/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2401.00421","created_at":"2026-07-05T07:29:18.266695+00:00"},{"alias_kind":"arxiv_version","alias_value":"2401.00421v1","created_at":"2026-07-05T07:29:18.266695+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2401.00421","created_at":"2026-07-05T07:29:18.266695+00:00"},{"alias_kind":"pith_short_12","alias_value":"UROY7UW2DJB2","created_at":"2026-07-05T07:29:18.266695+00:00"},{"alias_kind":"pith_short_16","alias_value":"UROY7UW2DJB2ERM3","created_at":"2026-07-05T07:29:18.266695+00:00"},{"alias_kind":"pith_short_8","alias_value":"UROY7UW2","created_at":"2026-07-05T07:29:18.266695+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":5,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.12303","citing_title":"From 2D Grids to 1D Tokens: Reforming Shared Representations for Multimodal Image Fusion","ref_index":6,"is_internal_anchor":false},{"citing_arxiv_id":"2605.25775","citing_title":"DRFusion: Drift-Resilient Temporally Consistent Infrared-Visible Video Fusion","ref_index":2,"is_internal_anchor":false},{"citing_arxiv_id":"2605.13049","citing_title":"Uncertainty-aware Spatial-Frequency Registration and Fusion for Infrared and Visible Images","ref_index":14,"is_internal_anchor":false},{"citing_arxiv_id":"2604.08924","citing_title":"Customized Fusion: A Closed-Loop Dynamic Network for Adaptive Multi-Task-Aware Infrared-Visible Image Fusion","ref_index":20,"is_internal_anchor":false},{"citing_arxiv_id":"2605.01916","citing_title":"EAPFusion: Intrinsic Evolving Auxiliary Prior Guidance for Infrared and Visible Image Fusion","ref_index":20,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW","json":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW.json","graph_json":"https://pith.science/api/pith-number/UROY7UW2DJB2ERM3L6SUGV5HSW/graph.json","events_json":"https://pith.science/api/pith-number/UROY7UW2DJB2ERM3L6SUGV5HSW/events.json","paper":"https://pith.science/paper/UROY7UW2"},"agent_actions":{"view_html":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW","download_json":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW.json","view_paper":"https://pith.science/paper/UROY7UW2","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2401.00421&json=true","fetch_graph":"https://pith.science/api/pith-number/UROY7UW2DJB2ERM3L6SUGV5HSW/graph.json","fetch_events":"https://pith.science/api/pith-number/UROY7UW2DJB2ERM3L6SUGV5HSW/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW/action/timestamp_anchor","attest_storage":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW/action/storage_attestation","attest_author":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW/action/author_attestation","sign_citation":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW/action/citation_signature","submit_replication":"https://pith.science/pith/UROY7UW2DJB2ERM3L6SUGV5HSW/action/replication_record"}},"created_at":"2026-07-05T07:29:18.266695+00:00","updated_at":"2026-07-05T07:29:18.266695+00:00"}