{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:PSLRHO2JFPFEDQFXNAFMY7QTUN","short_pith_number":"pith:PSLRHO2J","schema_version":"1.0","canonical_sha256":"7c9713bb492bca41c0b7680acc7e13a35c9f0fad185cc0258004af06aeb285e1","source":{"kind":"arxiv","id":"2506.12853","version":2},"attestation_state":"computed","paper":{"title":"EraserDiT: Fast Video Inpainting with Diffusion Transformer Model","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Jie Liu, Zheng Hui","submitted_at":"2025-06-15T13:59:57Z","abstract_excerpt":"Video object removal and inpainting are critical tasks in the fields of computer vision and multimedia processing, aimed at restoring missing or corrupted regions in video sequences. Traditional methods predominantly rely on flow-based propagation and spatio-temporal Transformers, but these approaches face limitations in effectively leveraging long-term temporal features and ensuring temporal consistency in the completion results, particularly when dealing with large masks. Consequently, performance on extensive masked areas remains suboptimal. To address these challenges, this paper introduce"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2506.12853","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2025-06-15T13:59:57Z","cross_cats_sorted":[],"title_canon_sha256":"be20e5776ba2f88fc3ed84cf7d37fe6e68e9894c450bed22fbb4723150d8b624","abstract_canon_sha256":"5853a433f0d650598db455c49b1b738428d480d501b23ce4ece5ba379611f97f"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:54:48.367068Z","signature_b64":"cfk8okvjAEgHEHyENFbK9HSLRcsO/Woke4Tuh5a4XIPNvMUJO85roi6bpdRePqSGBBX8MQRCTQpCxtS2LzzICw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"7c9713bb492bca41c0b7680acc7e13a35c9f0fad185cc0258004af06aeb285e1","last_reissued_at":"2026-07-05T11:54:48.366518Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:54:48.366518Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"EraserDiT: Fast Video Inpainting with Diffusion Transformer Model","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Jie Liu, Zheng Hui","submitted_at":"2025-06-15T13:59:57Z","abstract_excerpt":"Video object removal and inpainting are critical tasks in the fields of computer vision and multimedia processing, aimed at restoring missing or corrupted regions in video sequences. Traditional methods predominantly rely on flow-based propagation and spatio-temporal Transformers, but these approaches face limitations in effectively leveraging long-term temporal features and ensuring temporal consistency in the completion results, particularly when dealing with large masks. Consequently, performance on extensive masked areas remains suboptimal. To address these challenges, this paper introduce"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2506.12853","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2506.12853/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2506.12853","created_at":"2026-07-05T11:54:48.366586+00:00"},{"alias_kind":"arxiv_version","alias_value":"2506.12853v2","created_at":"2026-07-05T11:54:48.366586+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2506.12853","created_at":"2026-07-05T11:54:48.366586+00:00"},{"alias_kind":"pith_short_12","alias_value":"PSLRHO2JFPFE","created_at":"2026-07-05T11:54:48.366586+00:00"},{"alias_kind":"pith_short_16","alias_value":"PSLRHO2JFPFEDQFX","created_at":"2026-07-05T11:54:48.366586+00:00"},{"alias_kind":"pith_short_8","alias_value":"PSLRHO2J","created_at":"2026-07-05T11:54:48.366586+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":2,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2605.30045","citing_title":"GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver","ref_index":15,"is_internal_anchor":false},{"citing_arxiv_id":"2603.21901","citing_title":"CLEAR: Context-Aware Learning with End-to-End Mask-Free Inference for Adaptive Video Subtitle Removal","ref_index":5,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN","json":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN.json","graph_json":"https://pith.science/api/pith-number/PSLRHO2JFPFEDQFXNAFMY7QTUN/graph.json","events_json":"https://pith.science/api/pith-number/PSLRHO2JFPFEDQFXNAFMY7QTUN/events.json","paper":"https://pith.science/paper/PSLRHO2J"},"agent_actions":{"view_html":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN","download_json":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN.json","view_paper":"https://pith.science/paper/PSLRHO2J","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2506.12853&json=true","fetch_graph":"https://pith.science/api/pith-number/PSLRHO2JFPFEDQFXNAFMY7QTUN/graph.json","fetch_events":"https://pith.science/api/pith-number/PSLRHO2JFPFEDQFXNAFMY7QTUN/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN/action/timestamp_anchor","attest_storage":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN/action/storage_attestation","attest_author":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN/action/author_attestation","sign_citation":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN/action/citation_signature","submit_replication":"https://pith.science/pith/PSLRHO2JFPFEDQFXNAFMY7QTUN/action/replication_record"}},"created_at":"2026-07-05T11:54:48.366586+00:00","updated_at":"2026-07-05T11:54:48.366586+00:00"}