腾讯混元文生视频怎么在ComfyUI搭建文字生成流程

云涛吖_8200

云涛吖_8200

2026-10-05

338人浏览

原创

必须严格匹配模型结构、节点依赖与文本编码器版本——使用comfyui+pytorch 2.5.1环境,安装hunyuanvideo wrapper节点,部署fp8主模型、vae及clip_l/llava_llama3文本编码器,按序连接clip text encode(qwen2.5 vl)与t2v节点,设置video_length≤8、cfg 7.0~8.5,中文提示词优先。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

腾讯混元文生视频怎么在comfyui搭建文字生成流程

要在ComfyUI中稳定运行腾讯混元HunyuanVideo 1.5实现文字生成视频(T2V),必须严格匹配模型结构、节点依赖与文本编码器版本,缺一不可——用错一个safetensors文件或漏装CLIP Vision节点,都会导致黑帧、崩溃或提示词完全失效。

搭建基础环境:ComfyUI + PyTorch + 自定义环境

打开终端,执行:git clone https://github.com/comfyanonymous/ComfyUI.git → 进入ComfyUI目录后,创建独立conda环境:conda create -n hunyuan310 python=3.10.9 → 激活环境:conda activate hunyuan310 → 安装指定版本PyTorch:pip install torch==2.5.1 torchvision==0.20.1 torchaudio==2.5.1 --index-url https://download.pytorch.org/whl/cu124。注意:使用2.4.0或nightly会导致生成纯黑视频,【torch版本必须锁定为2.5.1】。

安装完后运行python main.py,确认http://127.0.0.1:8188可正常访问。

安装核心节点:HunyuanVideo Wrapper与配套编码器

方法一(推荐):进入ComfyUI/custom_nodes目录,执行:git clone https://github.com/kijai/ComfyUI-HunyuanVideoWrapper.git → 进入该目录运行pip install -r requirements.txt。

方法二(备用):若已装ComfyUI-Manager,需先将config.ini中security_level = weak,再通过WebUI界面在线搜索安装ComfyUI-HunyuanVideoWrapper。

安装完成后重启ComfyUI服务,刷新页面,检查左侧节点栏是否出现HunyuanVideo T2V和CLIP Text Encode (Qwen2.5 VL)两项——没有则说明custom_nodes未正确加载或路径有误。

部署模型文件:三类文件缺一不可

第一步:下载FP8量化主模型(最低显存门槛):
从Hugging Face下载:hunyuan_video_720_cfgdistill_fp8_e4m3fn.safetensors(约12GB),放入ComfyUI/models/diffusion_models/。

Qwen Vision
Qwen Vision

利用通义千问视觉API(阿里云灵积)分析图像和视频,支持图像理解、OCR及视觉推理。

下载

第二步:下载VAE模型:hunyuan_video_vae_bf16.safetensors,同样放入diffusion_models/目录。

第三步:下载文本编码器:
• clip_l.safetensors
• llava_llama3_fp8_scaled.safetensors
这两者必须放进ComfyUI/models/text_encoders/,否则Qwen2.5 VL节点无法加载,提示词将彻底失效。【text_encoders目录名不可写成encoders或text_encoder】。

配置T2V工作流:连接顺序不能错

步骤一:拖入HunyuanVideo T2V节点 → 拖入CLIP Text Encode (Qwen2.5 VL)节点 → 将后者“CLIP_L”输出端口连接至前者“prompt”输入口。

步骤二:在CLIP Text Encode节点的文本框中输入提示词,例如:“航拍视角,金色麦田随风起伏,远处山峦轮廓柔和,晨雾弥漫,电影感胶片色调”。中文提示词效果优于英文,但需避免生僻字或标点堆砌。

步骤三:在T2V节点中设置关键参数:
• video_length:建议设为6或8(单位:秒),超过10秒易OOM;
• resolution:选1080p或720p,不支持自定义尺寸;
• cfg:设为7.0~8.5之间,低于6.0运动模糊严重,高于9.0易卡顿失真;
• seed:填-1启用随机,固定数值用于复现结果。

步骤四:点击右上角Queue Prompt,等待生成完成。输出视频自动保存至ComfyUI/output/,格式为MP4,无需额外转码。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
腾讯混元使用教程大全
腾讯混元使用教程大全

从零开始学习腾讯混元,涵盖AI问答、内容创作、资料整理、办公辅助、代码生成、学习应用等场景,通过实战教程帮助用户快速掌握腾讯混元。

2026.06.11

402

10

腾讯混元Prompt大全
腾讯混元Prompt大全

收录腾讯混元热门Prompt模板,涵盖AI写作、办公文档、自媒体运营、电商推广、代码开发、学习教育等场景,帮助用户获得更高质量AI输出结果。

2026.06.11

425

10

腾讯混元开发平台教程
腾讯混元开发平台教程

面向开发者提供腾讯混元开放平台、API调用、SDK接入、智能体开发、Agent构建及企业级AI应用开发教程,帮助快速完成腾讯混元能力集成。

2026.06.11

441

10

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

2026.09.30

80

10

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

2026.09.30

80

14

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

2026.09.30

40

12

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

2026.09.30

40

26

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

2026.09.29

60

15

Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

2026.09.23

280

15

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程