在上一篇里,我们把「从剧本到成片」的生产流水线拆成了剧本、分镜、角色、生成、配音、剪辑、发布、变现八个环节。今天要解决一个最现实的问题:这套流水线到底跑在什么机器上? 无论你后面用 ComfyUI 还是 MiniMax H3、LTX 2.3,第一道门槛永远是算力环境。
选错环境,轻则训练一个 LoRA 要等一整晚,重则显存溢出(OOM)直接无法出图出视频。这一篇我们把本地 GPU、云 GPU 的账算清楚,再给出一套可以直接照抄的工具选型清单。

一、核心概念:先搞清楚三件事
1. 显存(VRAM)是唯一硬门槛
AI 视频生成和普通文生图不同,它需要同时把 UNet、VAE、CLIP 文本编码器以及一整段视频帧序列都装进显存。显存大小直接决定你能跑多大的分辨率、多长的视频。 经验值如下:
- 8 GB:只能跑 512×512 的图,视频基本跑不动;
- 12 GB:可跑 ComfyUI 文生图、短时长 AnimateDiff,视频会紧张;
- 16 GB:LTX 2.3 单镜头可用,是入门的甜点位;
- 24 GB:主流选择,ComfyUI 视频工作流、LoRA 训练都能覆盖;
- 48 GB 及以上:批量生成、长视频、高清角色一致性训练。
2. 算力(CUDA 核心)决定速度
显存够不够决定「能不能跑」,算力强不强决定「跑多快」。同样的 24 GB,RTX 4090 和 RTX 3090 出视频的速度能差出一倍以上。如果你以「日更短剧」为目标,算力就是每天能出的镜头数。
3. 存储与内存是隐性成本
一个 30 秒的 AI 视频中间会生成大量临时帧、缓存和控制网特征,模型权重本身也要几十 GB。建议:
- 内存(RAM)至少 32 GB,模型加载和批处理才不会频繁卡顿;
- 固态硬盘(SSD)至少 1 TB,放模型权重和素材;
- 机械硬盘(HDD)做冷备份,存放成片和历史素材。
二、方案对比:本地 GPU vs 云 GPU
方案 A:本地 GPU
适合:长期日更、对素材和模型完全掌控、有一定硬件预算。
- 优点:一次性投入、无按小时计费焦虑、模型与素材全在本地、隐私可控;
- 缺点:前期成本高、电费与散热、显卡换代贬值。
方案 B:云 GPU
适合:新手试水、按需爆量、不想维护硬件。
- 优点:按需付费、随时换卡、可弹性扩容;
- 缺点:长期跑下来不便宜、模型和素材要反复上传下载、网络延迟。
一个简单的判断公式:如果你每周生成视频超过 10 小时,本地显卡更划算;如果只是周末玩一玩,先租云 GPU 试水更理性。
三、实战步骤:一步步搭好环境
步骤 1:选定显卡(本地方案)
入门 RTX 3060 12GB 便宜,跑文生图/短训练
推荐主力 RTX 4090 24GB 视频生成速度天花板
性价比 RTX 3090 24GB 二手性价比高,显存大
专业量产 RTX 6000 Ada 48GB 大显存,批量生产
步骤 2:安装驱动与 CUDA
以 Ubuntu 为例,安装 NVIDIA 驱动与 CUDA Toolkit:
# 更新源并安装 NVIDIA 驱动(以 550 为例)
sudo apt update
sudo apt install -y nvidia-driver-550
# 重启后验证驱动
nvidia-smi
# 安装 CUDA Toolkit(示例为 12.4)
wget https://developer.download.nvidia.com/compute/cuda/12.4.0/local_installers/cuda_12.4.0_550.54.14_linux.run
sudo sh cuda_12.4.0_550.54.14_linux.run --silent --toolkit
# 配置环境变量
echo 'export PATH=/usr/local/cuda-12.4/bin:$PATH' >> ~/.bashrc
echo 'export LD_LIBRARY_PATH=/usr/local/cuda-12.4/lib64:$LD_LIBRARY_PATH' >> ~/.bashrc
source ~/.bashrc
步骤 3:验证 PyTorch 是否吃到 GPU
import torch
print(torch.__version__)
print(torch.cuda.is_available()) # 应为 True
print(torch.cuda.get_device_name(0)) # 显示显卡型号
print(torch.cuda.mem_get_info()) # 显存总量与可用量
步骤 4:云 GPU 快速开通(以 AutoDL 为例)
# 租用一台 24GB 显存的实例后,SSH 登录
ssh -p <端口> root@<公网IP>
# 多数镜像已内置 CUDA 与 PyTorch,直接验证
python -c "import torch; print(torch.cuda.is_available())"
# 若需安装 ComfyUI,克隆仓库即可
git clone https://github.com/comfyanonymous/ComfyUI.git
cd ComfyUI && pip install -r requirements.txt
步骤 5:工具选型清单
| 环节 | 推荐工具 | 说明 |
|---|---|---|
| 工作流编排 | ComfyUI | 节点式,短剧分镜首选 |
| 全自动导演 | MiniMax H3 | 剧本自动生成分镜镜头 |
| 视频生成 | LTX 2.3 | 高质量动态镜头 |
| 模型下载 | huggingface-cli | 拉取模型权重 |
| 环境隔离 | Conda / venv | 避免依赖冲突 |
| 版本管理 | Git | 管理工作流与脚本 |
四、常见问题
Q1:显存不够怎么办?
优先顺序:降低分辨率 → 关闭高清修复 → 使用 --lowvram 参数 → 换更大显存显卡。切勿盲目加大批处理(batch size),显存不足会导致直接 OOM。
Q2:云 GPU 一小时多少钱?
24 GB 显存(如 4090/A5000)常见价格在 2~4 元/小时,长期跑可以包月,性价比更高。
Q3:本地显卡温度多高算正常?
满载 70~85℃ 都在安全范围,超过 90℃ 要检查散热或降低功耗。
Q4:驱动和 CUDA 版本要对齐吗?
要。PyTorch、CUDA、驱动三者版本必须互相兼容,建议到 PyTorch 官网按你的 CUDA 版本生成安装命令。
五、总结
今天把环境准备这件事拆成了「显存、算力、存储」三个核心概念,对比了本地 GPU 与云 GPU 两种路线,并给出了从装驱动到验证 PyTorch 的完整步骤。结论很简单:入门先租云 GPU 试水,确定长期日更后再上 24 GB 本地显卡。
环境就绪之后,下一篇我们正式进入创作上游——用大模型写剧本和分镜脚本,把「一句话创意」变成可执行的镜头列表。
下期预告
下一篇《第 4 天:AI 剧本与分镜——用大模型创作剧本和分镜脚本》,我会教你如何用大模型把创意拆成分镜表,并给出可直接复用的提示词模板。明天见!















暂无评论内容