
今天给大家演示一个多模态 Coze 工作流,它结合了文本生成、图像生成、音频合成和视频草稿创建的功能,能够实现从输入主题到输出完整视频草稿的全流程自动化。整个流程不仅依赖大模型进行文案和标题的生成,还通过循环节点批量生成图片描述词、图像、音频配音以及图生视频描述词,最终利用代码节点和剪映插件完成草稿的合成与输出。这样,用户可以一键生成可直接用于视频创作的成品草稿,极大提高创作效率。文章目录工作流介绍核心模型Node节点工作流程大模型应用文案生成模型标题生成模型图像描述词生成模型图生视频描述生成模型使用方法应用场景开发与应用工作流介绍这个工作流以大模型为核心驱动,配合循环控制、音视频合成插件和代码逻辑,完成从文案策划、标题生成到图片、音频、视频的多模态内容生成。最终通过剪映助手插件创建视频草稿,实现字幕、音频、特效和背景音乐的统一整合,形成一个完整的视频制作流程。核心模型在这个工作流中,核心模型主要承担了文案生成、标题拟写、图片描述词生成以及图生视频描述词推导等任务。不同节点分别调用不同的大语言模型或专用推理模型,保证了文本与视觉素材的一致性和专业性。模型名称说明DeepSeek-V3-0324用于根据输入主题生成养生类风格的文案豆包·工具调用用于标题生成、图片描述词生成、图生视频描述词生成等任务,保证简洁高效Node节点整个工作流由多个 Node 节点组成,每个节点对应特定的功能模块。从文案生成到素材整合,再到最终的草稿创建,这些节点相互衔接,确保工作流的完整性与自动化