AI短剧系列 | 第 3 天:环境准备——本地 GPU、云 GPU 与工具选型指南

在上一篇里,我们把「从剧本到成片」的生产流水线拆成了剧本、分镜、角色、生成、配音、剪辑、发布、变现八个环节。今天要解决一个最现实的问题:这套流水线到底跑在什么机器上? 无论你后面用 ComfyUI 还是 MiniMax H3、LTX 2.3,第一道门槛永远是算力环境。

选错环境,轻则训练一个 LoRA 要等一整晚,重则显存溢出(OOM)直接无法出图出视频。这一篇我们把本地 GPU、云 GPU 的账算清楚,再给出一套可以直接照抄的工具选型清单。

AI短剧 第3天

一、核心概念:先搞清楚三件事

1. 显存(VRAM)是唯一硬门槛

AI 视频生成和普通文生图不同,它需要同时把 UNet、VAE、CLIP 文本编码器以及一整段视频帧序列都装进显存。显存大小直接决定你能跑多大的分辨率、多长的视频。 经验值如下:

  • 8 GB:只能跑 512×512 的图,视频基本跑不动;
  • 12 GB:可跑 ComfyUI 文生图、短时长 AnimateDiff,视频会紧张;
  • 16 GB:LTX 2.3 单镜头可用,是入门的甜点位;
  • 24 GB:主流选择,ComfyUI 视频工作流、LoRA 训练都能覆盖;
  • 48 GB 及以上:批量生成、长视频、高清角色一致性训练。

2. 算力(CUDA 核心)决定速度

显存够不够决定「能不能跑」,算力强不强决定「跑多快」。同样的 24 GB,RTX 4090 和 RTX 3090 出视频的速度能差出一倍以上。如果你以「日更短剧」为目标,算力就是每天能出的镜头数。

3. 存储与内存是隐性成本

一个 30 秒的 AI 视频中间会生成大量临时帧、缓存和控制网特征,模型权重本身也要几十 GB。建议:

  • 内存(RAM)至少 32 GB,模型加载和批处理才不会频繁卡顿;
  • 固态硬盘(SSD)至少 1 TB,放模型权重和素材;
  • 机械硬盘(HDD)做冷备份,存放成片和历史素材。

二、方案对比:本地 GPU vs 云 GPU

方案 A:本地 GPU

适合:长期日更、对素材和模型完全掌控、有一定硬件预算。

  • 优点:一次性投入、无按小时计费焦虑、模型与素材全在本地、隐私可控;
  • 缺点:前期成本高、电费与散热、显卡换代贬值。

方案 B:云 GPU

适合:新手试水、按需爆量、不想维护硬件。

  • 优点:按需付费、随时换卡、可弹性扩容;
  • 缺点:长期跑下来不便宜、模型和素材要反复上传下载、网络延迟。

一个简单的判断公式:如果你每周生成视频超过 10 小时,本地显卡更划算;如果只是周末玩一玩,先租云 GPU 试水更理性。

三、实战步骤:一步步搭好环境

步骤 1:选定显卡(本地方案)

入门         RTX 3060 12GB       便宜,跑文生图/短训练
推荐主力     RTX 4090 24GB       视频生成速度天花板
性价比       RTX 3090 24GB       二手性价比高,显存大
专业量产     RTX 6000 Ada 48GB   大显存,批量生产

步骤 2:安装驱动与 CUDA

以 Ubuntu 为例,安装 NVIDIA 驱动与 CUDA Toolkit:

# 更新源并安装 NVIDIA 驱动(以 550 为例)
sudo apt update
sudo apt install -y nvidia-driver-550
# 重启后验证驱动
nvidia-smi

# 安装 CUDA Toolkit(示例为 12.4)
wget https://developer.download.nvidia.com/compute/cuda/12.4.0/local_installers/cuda_12.4.0_550.54.14_linux.run
sudo sh cuda_12.4.0_550.54.14_linux.run --silent --toolkit
# 配置环境变量
echo 'export PATH=/usr/local/cuda-12.4/bin:$PATH' >> ~/.bashrc
echo 'export LD_LIBRARY_PATH=/usr/local/cuda-12.4/lib64:$LD_LIBRARY_PATH' >> ~/.bashrc
source ~/.bashrc

步骤 3:验证 PyTorch 是否吃到 GPU

import torch
print(torch.__version__)
print(torch.cuda.is_available())          # 应为 True
print(torch.cuda.get_device_name(0))      # 显示显卡型号
print(torch.cuda.mem_get_info())          # 显存总量与可用量

步骤 4:云 GPU 快速开通(以 AutoDL 为例)

# 租用一台 24GB 显存的实例后,SSH 登录
ssh -p <端口> root@<公网IP>
# 多数镜像已内置 CUDA 与 PyTorch,直接验证
python -c "import torch; print(torch.cuda.is_available())"
# 若需安装 ComfyUI,克隆仓库即可
git clone https://github.com/comfyanonymous/ComfyUI.git
cd ComfyUI && pip install -r requirements.txt

步骤 5:工具选型清单

环节 推荐工具 说明
工作流编排 ComfyUI 节点式,短剧分镜首选
全自动导演 MiniMax H3 剧本自动生成分镜镜头
视频生成 LTX 2.3 高质量动态镜头
模型下载 huggingface-cli 拉取模型权重
环境隔离 Conda / venv 避免依赖冲突
版本管理 Git 管理工作流与脚本

四、常见问题

Q1:显存不够怎么办?

优先顺序:降低分辨率 → 关闭高清修复 → 使用 --lowvram 参数 → 换更大显存显卡。切勿盲目加大批处理(batch size),显存不足会导致直接 OOM。

Q2:云 GPU 一小时多少钱?

24 GB 显存(如 4090/A5000)常见价格在 2~4 元/小时,长期跑可以包月,性价比更高。

Q3:本地显卡温度多高算正常?

满载 70~85℃ 都在安全范围,超过 90℃ 要检查散热或降低功耗。

Q4:驱动和 CUDA 版本要对齐吗?

要。PyTorch、CUDA、驱动三者版本必须互相兼容,建议到 PyTorch 官网按你的 CUDA 版本生成安装命令。

五、总结

今天把环境准备这件事拆成了「显存、算力、存储」三个核心概念,对比了本地 GPU 与云 GPU 两种路线,并给出了从装驱动到验证 PyTorch 的完整步骤。结论很简单:入门先租云 GPU 试水,确定长期日更后再上 24 GB 本地显卡。

环境就绪之后,下一篇我们正式进入创作上游——用大模型写剧本和分镜脚本,把「一句话创意」变成可执行的镜头列表。

下期预告

下一篇《第 4 天:AI 剧本与分镜——用大模型创作剧本和分镜脚本》,我会教你如何用大模型把创意拆成分镜表,并给出可直接复用的提示词模板。明天见!

微信二维码
© 版权声明
THE END
喜欢就支持一下吧
点赞0 分享
评论 抢沙发
头像
欢迎您留下宝贵的见解!
提交
头像

昵称

取消
昵称表情代码图片快捷回复

    暂无评论内容