片段级双通道多模态约束的广告视频生成方法以及系统

By introducing a knowledge base of subjects, templates, and generation tools, and combining a multimodal model and tool scoring mechanism, the problems of unstable script planning, poor multimodal consistency, and insufficient device adaptation in advertising video generation are solved. This achieves high-quality advertising video generation with clear logic and visual consistency, adapting to the application needs of multiple industries and multiple terminals.

CN121691835BActive Publication Date: 2026-07-17SHENZHEN ZHIXIANG FUTURE TECHNOLOGY CO LTD

Patent Information

Authority / Receiving Office
CN · China
Patent Type
Patents(China)
Current Assignee / Owner
SHENZHEN ZHIXIANG FUTURE TECHNOLOGY CO LTD
Filing Date
2025-11-06
Publication Date
2026-07-17

AI Technical Summary

Technical Problem

Existing advertising video generation methods suffer from problems such as unstable script planning, poor multimodal consistency, uncontrollable tool selection, and insufficient device adaptation, making it difficult for the generated videos to meet commercial-grade requirements in terms of logical coherence, visual consistency, and device adaptability.

Method used

An advertising video generation method with segment-level dual-channel multimodal constraints is adopted. By introducing a subject knowledge base, a template knowledge base, and a generation tool knowledge base, a structured script is generated. The multimodal model is combined to fuse image and text information, and a tool scoring and rollback mechanism is introduced to optimize the generation effect and display quality.

Benefits of technology

It achieves clear logic and unified visual style in advertising video generation, improves generation stability and efficiency, adapts to differentiated expansion across multiple industries and terminals, and has good engineering feasibility and commercial application value.

✦ Generated by Eureka AI based on patent content.

Smart Images

  • Figure CN121691835B_ABST
    Figure CN121691835B_ABST
Patent Text Reader

Abstract

本发明提供一种片段级双通道多模态约束的广告视频生成方法,该方法基于行业、主体和模板输入,检索主体知识库、模板知识库、生成工具知识库,生成含片段数量、图像生成引导信息、视频生成引导信息及生成工具的结构化广告脚本;根据图像生成引导信息生成片段图像,并将图像生成引导信息与系统预设文本提示相结合,经多模态模型生成视频生成引导信息;再将片段图像与视频生成引导信息输入广告脚本指定的生成工具,得到片段视频,并通过自适应语义相似度门控、设备适配及回退策略,对不达标结果进行重生成或降级处理,最终组合得到广告视频。该方法能够提升广告视频生成的一致性、稳定性、逻辑性和终端适配性。
Need to check novelty before this filing date? Find Prior Art