{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:FC6CPHEWVE2BJB5CNH2ZRRGIDE","short_pith_number":"pith:FC6CPHEW","schema_version":"1.0","canonical_sha256":"28bc279c96a9341487a269f598c4c819155a504573a13077bde95a6d31a3f88c","source":{"kind":"arxiv","id":"2506.00667","version":1},"attestation_state":"computed","paper":{"title":"Scene Detection Policies and Keyframe Extraction Strategies for Large-Scale Video Analysis","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.MM"],"primary_cat":"cs.CV","authors_text":"Vasilii Korolkov","submitted_at":"2025-05-31T18:37:21Z","abstract_excerpt":"Robust scene segmentation and keyframe extraction are essential preprocessing steps in video understanding pipelines, supporting tasks such as indexing, summarization, and semantic retrieval. However, existing methods often lack generalizability across diverse video types and durations. We present a unified, adaptive framework for automatic scene detection and keyframe selection that handles formats ranging from short-form media to long-form films, archival content, and surveillance footage. Our system dynamically selects segmentation policies based on video length: adaptive thresholding for s"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2506.00667","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CV","submitted_at":"2025-05-31T18:37:21Z","cross_cats_sorted":["cs.MM"],"title_canon_sha256":"5736d3a713a92748caad36cae8ee7f87ef8737e5b1f1addf3ec1b45ce82e8807","abstract_canon_sha256":"aa3802955cbc1ab8cba09f28e1b3bcfb99786ead47e077679a27be091439327d"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:13:38.266592Z","signature_b64":"hQyrrgjJoEV1/tYBGekDuskHXU6ZVLTA6O371EuVTEH8ZqI0XyPJ3htSU2CFlYgqTNDQXiCtXVmUem4yuabcAw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"28bc279c96a9341487a269f598c4c819155a504573a13077bde95a6d31a3f88c","last_reissued_at":"2026-07-05T11:13:38.266100Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:13:38.266100Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Scene Detection Policies and Keyframe Extraction Strategies for Large-Scale Video Analysis","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.MM"],"primary_cat":"cs.CV","authors_text":"Vasilii Korolkov","submitted_at":"2025-05-31T18:37:21Z","abstract_excerpt":"Robust scene segmentation and keyframe extraction are essential preprocessing steps in video understanding pipelines, supporting tasks such as indexing, summarization, and semantic retrieval. However, existing methods often lack generalizability across diverse video types and durations. We present a unified, adaptive framework for automatic scene detection and keyframe selection that handles formats ranging from short-form media to long-form films, archival content, and surveillance footage. Our system dynamically selects segmentation policies based on video length: adaptive thresholding for s"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2506.00667","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2506.00667/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2506.00667","created_at":"2026-07-05T11:13:38.266158+00:00"},{"alias_kind":"arxiv_version","alias_value":"2506.00667v1","created_at":"2026-07-05T11:13:38.266158+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2506.00667","created_at":"2026-07-05T11:13:38.266158+00:00"},{"alias_kind":"pith_short_12","alias_value":"FC6CPHEWVE2B","created_at":"2026-07-05T11:13:38.266158+00:00"},{"alias_kind":"pith_short_16","alias_value":"FC6CPHEWVE2BJB5C","created_at":"2026-07-05T11:13:38.266158+00:00"},{"alias_kind":"pith_short_8","alias_value":"FC6CPHEW","created_at":"2026-07-05T11:13:38.266158+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2508.04895","citing_title":"Automated Bug Frame Retrieval from Gameplay Videos Using Vision-Language Models","ref_index":22,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE","json":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE.json","graph_json":"https://pith.science/api/pith-number/FC6CPHEWVE2BJB5CNH2ZRRGIDE/graph.json","events_json":"https://pith.science/api/pith-number/FC6CPHEWVE2BJB5CNH2ZRRGIDE/events.json","paper":"https://pith.science/paper/FC6CPHEW"},"agent_actions":{"view_html":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE","download_json":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE.json","view_paper":"https://pith.science/paper/FC6CPHEW","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2506.00667&json=true","fetch_graph":"https://pith.science/api/pith-number/FC6CPHEWVE2BJB5CNH2ZRRGIDE/graph.json","fetch_events":"https://pith.science/api/pith-number/FC6CPHEWVE2BJB5CNH2ZRRGIDE/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE/action/timestamp_anchor","attest_storage":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE/action/storage_attestation","attest_author":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE/action/author_attestation","sign_citation":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE/action/citation_signature","submit_replication":"https://pith.science/pith/FC6CPHEWVE2BJB5CNH2ZRRGIDE/action/replication_record"}},"created_at":"2026-07-05T11:13:38.266158+00:00","updated_at":"2026-07-05T11:13:38.266158+00:00"}