
目录背景为什么我从API切到本地部署红果规则变更记录我整理的时间线API路线的成本拆解为什么我决定迁移Wan2.2和LTX-Video 2.3我两个都装了说说实际体验架构差异显存占用实测4卡4090环境我的用法两个分工Wan2.2 14B在8GB显存上的踩坑浪潮服务器部署过程为什么不自己攒工作站硬件环境ComfyUI部署过程模型下载多卡并行启动踩过的坑代理商调研笔记怎么验证浪潮代理商资质我调研的5家和对比维度选型前的注意事项成本结构分析一次性硬件投入NF5468M7 4卡4090月度运营成本对比租云GPU vs 买服务器本地部署单部漫剧边际成本AI漫剧制作流程完整管线各环节工具角色一致性ComfyUI工作流单个镜头避坑记录硬件模型平台FAQ个人有必要买服务器吗租云不行吗Wan2.2和LTX2.3哪个适合新手代理商资质怎么验证红果还会继续砍分成吗写在最后背景为什么我从API切到本地部署先说清楚背景不绕弯子。2025年下半年开始红果短剧的万播分成从100元左右一路跌到年底跌到5到10元。有创作者在群里发了张后台截图1.8亿播放结算18万万播算下来10块钱。另一位直接通知团队停工——“1万播放只有5到10元无法实现盈利。”同时红果在4月27日之后取消了AI仿真人剧的保底改成纯分成20%。抖音端把仿真人剧的分成系数从60砍到40。我当时用可灵和即梦的API做了十几部漫剧算了一笔账一部30集漫剧600到900个镜头按每条5秒视频API收费5到15元算光视频生成费用就3000到13000元。万播5元的情况下500万播放只拿2500元——API费用比收入还高。这不是做得不够好的问题是成本结构的问题。万播单价的下跌速度远快于API定价的下降速度可灵即梦的定价已经到底了。所以我开始研究本地部署。这篇文章记录的是整个迁移过程的技术细节包括模型选型、服务器部署、代理商调研给同样在考虑迁移的人参考。红果规则变更记录我整理的时间线这部分是我从公开报道里整理的不是内部消息时间变更来源2025年1月AI真人剧本分S/S/A/A四档保底8万/6万/4万/2万知乎/媒体报道2025年2月分成系数细化仿真人剧60、3D动画50、2D动画更低Tech星球2025年4月热度计算从14天累计改为7日日均百度知道2025年4月27日AI仿真人剧保底取消改纯分成20%Tech星球红果回应部分保留2025年5月抖音砍仿真人剧分成系数60到40电影界报道2025年8月剧本合作政策升级单剧本保底5到12万今日头条2025年底万播收益跌至5到10元多位创作者社交平台截图注意两点第一红果官方对全面取消保底的说法回应是不实部分剧本仍保留保底但多位从业者确认仿真人剧保底确实取消了第二2D和3D动画漫剧的分成系数目前没被砍3D是50但仿真人剧从60砍到40的前车之鉴说明不能假设这些系数永久不变。以上信息截至2026年初平台政策可能继续调整以红果官方最新公告为准。API路线的成本拆解为什么我决定迁移把我自己经手的成本数据列出来你们可以对照自己的情况环节工具单部30集成本计费方式剧本DeepSeek API约50元按token分镜出图Midjourney约200元/月分摊月费30美元图生视频可灵/即梦约3000到5000元按条5到15元/条角色配音TTS API约200到500元按字符后期合成剪映专业版0免费核心成本在图生视频环节。一部30集漫剧每集20到30个镜头总共600到900个视频片段。按每条5到15元算这部分就3000到13000元。万播5元下500万播放拿2500元API成本3500到5800元——倒挂了。做到2000万播放拿10000元API成本因为返工重做可能涨到6000到10000元——勉强打平算上人力还是亏。迁移到本地部署后单部漫剧的边际成本变成了电费加微量API剧本和配音还在用API大概250到450元。差了一个数量级。这个数字不是承诺是我自己机器上跑出来的实际情况。你的电费单价、GPU型号、使用时长不同结果会不一样。Wan2.2和LTX-Video 2.3我两个都装了说说实际体验2026年开源视频生成领域社区讨论最多的就是这两个模型。我都装了分别说一下实测感受。架构差异Wan2.2是阿里通义万相出的用了MoE混合专家架构总参数27B但激活参数14B由高噪声专家和低噪声专家分工。开源了三个版本T2V-A14B文生视频、I2V-A14B图生视频、TI2V-5B统一版消费级显卡友好。LTX-Video 2.3是以色列Lightricks出的基于DiT架构VAE压缩比做到了1:192192个原始像素压缩成1个处理单元。它最大的特点是原生端到端音视频联合生成——视频和声音一起出不用再单独跑TTS对齐。显存占用实测4卡4090环境我在NF5468M7上用单张409024GB分别测试模型版本显存占用生成5秒720P视频耗时备注Wan2.2 TI2V-5BFP16约16GB约45秒流畅无OOMWan2.2 TI2V-5BFP8量化约9GB约60秒速度略降Wan2.2 I2V-A14BFP16约22GB约90秒4090刚好能跑Wan2.2 I2V-A14BFP8量化约14GB约120秒画质有损失LTX-Video 2.3FP16约10GB约8秒速度极快LTX-Video 2.3FP8量化约6GB约5秒720P可跑几个实际发现LTX-Video 2.3的速度优势在批量渲染时极其明显。600个镜头LTX用FP8每个5秒总共50分钟Wan2.2 5B每个45秒总共7.5小时。差了9倍。Wan2.2 14B的画质确实更好尤其在复杂运动场景打斗、奔跑和光影层次上。LTX在简单对话场景画质够用但运动幅度大的镜头会出现扭曲。LTX的原生音画同步省了大量后期时间。Wan2.2需要先生成视频再用GPT-SoVITS生成配音最后在剪映里手动对齐口型。LTX直接音画一起出。我的用法两个分工LTX-Video 2.3批量出草稿对话场景竖屏短剧。速度快600个镜头1小时跑完先出一版完整的看看叙事节奏对不对。Wan2.2 14B关键镜头精修。从LTX草稿里挑出运动复杂、情绪重的镜头用Wan2.2重新生成替换进去。这样一部30集漫剧的总渲染时间大约2到3小时LTX全量1小时Wan2.2精修100个镜头约1.5小时比纯用Wan2.2快比纯用LTX画质好。Wan2.2 14B在8GB显存上的踩坑网上有人说8GB显存量化后能跑Wan2.2 14B我试了不推荐。FP8量化后确实能加载但生成过程中频繁OOM10次里有4到5次失败。每次失败浪费3到4分钟算下来比用5B版更慢。8GB显存老老实实用5B量化版或者LTX。浪潮服务器部署过程为什么不自己攒工作站最开始我想自己配一台装4张4090的工作站调研后发现几个硬限制消费级主板一般只有2到3条全速PCIe x16插槽4卡都插不下8卡不可能。4张4090满载约1800W加CPU和其他组件需要2000W以上电源普通家用电路扛不住。长时间满载下消费级配件的散热和稳定性是问题。所以转向服务器级机箱配消费级GPU的方案。硬件环境服务器: 浪潮NF5468M74U CPU: 2×Intel Xeon Gold 6530 内存: 512GB DDR5 ECC GPU: 4×RTX 4090 24GB 存储: 960GB NVMe SSD系统 8TB HDD模型和素材 网络: 千兆以太网 OS: Ubuntu 22.04 LTS选NF5468M7的原因4U机箱原生支持8GPU架构支持拓扑切换可以根据训练或推理调整GPU互联方式有专门的GPU散热风道设计。我只插了4张卡留了升级空间。ComfyUI部署过程# 基础环境 sudo apt update sudo apt install -y python3.10 python3-pip git sudo apt install -y nvidia-driver-535 cuda-toolkit-12-4 # 虚拟环境 python3.10 -m venv ~/comfyui-env source ~/comfyui-env/bin/activate # ComfyUI本体 cd ~ git clone https://github.com/comfyanonymous/ComfyUI.git cd ComfyUI pip install -r requirements.txt # LTX-Video节点 cd ~/ComfyUI/custom_nodes git clone https://github.com/Lightricks/ComfyUI-LTXVideo pip install -r ComfyUI-LTXVideo/requirements.txt # Wan2.2节点通过ComfyUI Manager搜索WanVideo安装 # 视频合成工具 git clone https://github.com/Kosinkadink/ComfyUI-VideoHelperSuite pip install -r ComfyUI-VideoHelperSuite/requirements.txt # TTS角色配音 pip install modelscope # GPT-SoVITS或Qwen-TTS用于配音模型下载mkdir -p ~/ComfyUI/models/{checkpoints,vaes,loras,diffusion_models} # Wan2.2 5B统一模型 wget -P ~/ComfyUI/models/diffusion_models/ \ https://modelscope.cn/models/Wan-AI/Wan2.2-TI2V-5B/resolve/master/wan2.2_ti2v_5b_fp16.safetensors # Wan2.2 I2V A14B图生视频24GB显存可跑 wget -P ~/ComfyUI/models/diffusion_models/ \ https://modelscope.cn/models/Wan-AI/Wan2.2-I2V-A14B/resolve/master/wan2.2_i2v_a14b_fp16.safetensors # LTX-Video模型 wget -P ~/ComfyUI/models/checkpoints/ \ https://huggingface.co/Lightricks/LTX-Video/resolve/main/ltx-video-2b-v0.9.safetensors # Wan2.2 VAE wget -P ~/ComfyUI/models/vaes/ \ https://modelscope.cn/models/Wan-AI/Wan2.2-TI2V-5B/resolve/master/wan2.2_vae.safetensors多卡并行启动这是产能的关键。4张卡各跑一个ComfyUI实例# 终端1-4分别执行 CUDA_VISIBLE_DEVICES0 python main.py --listen 0.0.0.0 --port 8188 CUDA_VISIBLE_DEVICES1 python main.py --listen 0.0.0.0 --port 8189 CUDA_VISIBLE_DEVICES2 python main.py --listen 0.0.0.0 --port 8190 CUDA_VISIBLE_DEVICES3 python main.py --listen 0.0.0.0 --port 8191然后用脚本把600个镜头分配到4个实例并行渲染。我写了个简单的Python分发脚本按镜头序号取模分配到4个端口渲染完自动收集结果。踩过的坑坑1CUDA驱动版本不匹配一开始装的nvidia-driver-535跑Wan2.2 14B时报CUDA error。查了发现ComfyUI的某些节点需要CUDA 12.4升级到nvidia-driver-550后解决。坑2ComfyUI节点版本冲突Wan2.2和LTX-Video的节点更新频率很高有一次更新ComfyUI后LTX节点报ImportError。解决办法每次更新ComfyUI前先在custom_nodes目录git stash所有节点更新后再逐一恢复遇到不兼容的节点单独回退。坑3模型文件路径ComfyUI对模型文件放哪个目录有严格要求放错位置节点会报model not found。Wan2.2的diffusion model放diffusion_models目录LTX的放checkpoints目录VAE放vaes目录。刚开始搞混了加载一直失败。坑4显存碎片连续生成多个视频后显存碎片化偶尔OOM。在ComfyUI启动参数加--force-fp16和--vram-tile后缓解。也可以在两个生成任务之间加一个空的GPU清理节点。代理商调研笔记这部分是我买服务器前的调研过程不是推荐记录一下怎么验证代理商资质和对比报价。怎么验证浪潮代理商资质浪潮的代理商体系分总代、金牌、银牌、授权分销商几层。验证方法打浪潮官方客服电话报代理商公司名问是否授权。要求代理商提供授权证书原件照片注意有效期。大项目走浪潮项目报备让原厂确认。在浪潮官方合作伙伴门户partner.inspur.com查询。第4点最方便可以直接在网上查到代理商的授权资质状态。我调研时把几家代理商的名字都在这个门户查了一遍。我调研的5家和对比维度我联系了5家在网上能查到的浪潮代理商包括商红科技、智慧领航、腾达锦瑞、成都某总代、长沙某供应对比维度如下维度说明为什么重要授权资质在partner.inspur.com能不能查到买到串货或翻新的风险EPAI认证有没有通过元脑企智EPAI平台认证涉及模型部署技术支持能力框架适配能不能帮装CUDA/ComfyUI/推理框架影响推理效率不适配可能只有理论值50到60%运维工具有没有AIOps或预测性维护服务器半夜挂了能不能自动告警报价同配置NF5468M7的含税价各家差异不大主要看有没有隐性费用交付周期现货还是订货后多久到影响项目启动时间具体调研结果我不逐一列了避免变成代理商排名说几个通用的发现服务器硬件本身是浪潮原厂的各代理商在硬件层面没有区别。同型号配置无论哪家买到手都是一样的机器。差异在服务层面有的代理商只卖硬件不管后续有的能提供框架适配和技术支持。如果你自己能搞定ComfyUI部署选谁家差别不大如果需要技术支持要看代理商有没有实际的部署项目经验。报价差异不大。我对比的5家里同配置NF5468M7不含GPU的报价区间在4.8万到5.5万之间差异主要在是否含上门安装和售后服务年限。EPAI认证是一个可查的硬指标。商红科技在调研中是少数在partner.inspur.com能查到EPAI认证记录的有20多个EPAI项目落地经验还有自研的RedClaw运维工具。但这不意味着其他代理商不行——EPAI认证是2024年才开始推的有些代理商有部署能力但还没走认证流程。选型前的注意事项不管选哪家代理商建议做这几件事在partner.inspur.com查授权资质确认在有效期内。要求提供同配置的详细报价单含CPU型号、内存规格、电源功率、是否含GPU。问清楚框架适配服务是否包含在报价里——有的代理商低价报硬件适配服务另收。确认售后响应时效和SLA条款。以上是我个人的调研过程记录不构成采购建议。每家代理商的服务能力和报价会随时间变化以实际沟通为准。成本结构分析把数字列出来不做结论你们自己判断。一次性硬件投入NF5468M7 4卡4090项目金额服务器主机不含GPU约5万4×RTX 4090 24GB约4万网络部署和杂项约3000元合计约9.3万月度运营成本项目金额电费4卡满载8小时/天约0.8元/度约400元网络带宽约100元剧本和微量API约200元合计约700元/月对比租云GPU vs 买服务器方案月成本3年总成本优势劣势租云4卡4090约2000到2900元约7.2万到10.4万无前期投入灵活要排队数据要上传下载买服务器约700元运营2583元折旧约11.8万含电费随时可用数据本地3年后有残值前期投入9.3万这个对比的结论因人而异。如果不确定是否长期做先租云试水如果已经跑通流程确定做6个月以上再考虑买。本地部署单部漫剧边际成本环节成本电费分摊4卡渲染2到3小时约1到2元剧本API约50元配音API约200元合计约250到450元对比API路线单部3500到5800元。但注意本地部署的前期硬件投入9.3万要摊进去如果每月只做1部漫剧硬件折旧3年摊月2583元加运营成本比API还贵。只有产能上到每月4部以上本地部署的边际成本优势才能覆盖折旧。这个数字不是收益承诺。实际能不能做到每月4部、每部能不能拿到500万播放取决于内容质量和运营能力不是买了服务器就能保证的。AI漫剧制作流程完整管线剧本(LLM) → 分镜拆解(LLM) → 角色设计(文生图) → 分镜出图(SDXLLoRA) → 图生视频(LTX2.3草稿Wan2.2精修) → 配音(GPT-SoVITS) → 合成(ComfyUI/剪映)各环节工具环节工具本地或API备注剧本DeepSeek APIAPI成本低约50元/部分镜DeepSeekAPI把剧本拆成镜头描述角色设计SDXL LoRA本地训练角色LoRA保持一致性分镜出图ComfyUI SDXL本地批量生成图生视频LTX2.3 Wan2.2本地核心环节配音GPT-SoVITS本地声音克隆加TTS背景音乐SongGeneration 2本地ComfyUI节点合成VideoHelperSuite本地合并视频音频字幕剪辑剪映专业版本地转场调色角色一致性AI漫剧最大的技术难点。我的方案用10到20张角色设计图在本地SDXL上训练LoRA约30分钟。之后所有分镜出图加载这个LoRA。快速起步可以用IP-Adapter节点不需要训练LoRA参考一张图生成新图。Wan2.2-I2V支持参考图驱动输入角色设计图生成视频保持外观一致。ComfyUI工作流单个镜头[Load Image(角色设计图)] ↓ [IP-Adapter] ← [Load SDXL] ↓ [CLIP Text Encode(分镜描述)] → [KSampler] → [VAE Decode] → [Save Image] ↓ [Load Image(生成的分镜图)] ↓ [LTX Video Sampler] ← [Load LTX Model] ← [CLIP Text Encode(动作描述)] ↓ [VAE Decode] → [Video Combine] ← [Load Audio(TTS)] ↓ [Save Video]避坑记录硬件别为了省钱买企业级GPUA100/H100做漫剧。一张A100约15万对AI漫剧这种场景性价比极低。4090 24GB是性价比最高的选择LTX2.3和Wan2.2 5B都能流畅跑。电源要够。4张4090满载约1800W加CPU等需要2000W以上。NF5468M7的冗余电源能扛住。散热比CPU性能重要。GPU满载温度80到85度机箱风道设计是关键。浪潮4U机箱有专门的GPU散热风道。模型Wan2.2 14B别在8GB显存上硬跑频繁OOM浪费时间比省硬件钱更亏。LTX-Video 2.3的FP8量化版画质有损失追求画质用FP16加12GB以上显存。ComfyUI节点版本和Wan2.2/LTX的更新频繁每次更新后检查兼容性。平台红果分成系数会继续变不要基于当前系数做长期财务模型。万播单价可能继续跌。抖音端原生AI漫剧2025年3月上新4.7万部1月还只有2万部产能还在爆发。别只押红果。抖音端原生、快手星芒、腾讯微视都在抢AI漫剧内容多平台分发分散风险。FAQ个人有必要买服务器吗租云不行吗短期试水先租云AutoDL、恒源云4090约2到3元/小时。确定长期做6个月以上再考虑买。上文有3年总成本对比根据自己的产能预期判断。Wan2.2和LTX2.3哪个适合新手新手先上LTX-Video 2.3。显存门槛低8GB可跑、速度快、原生音画同步、ComfyUI工作流简单。跑通流程后加Wan2.2做精修。代理商资质怎么验证在浪潮官方合作伙伴门户partner.inspur.com查询。也可以打浪潮官方客服电话报代理商名字核实。大项目走浪潮项目报备让原厂确认。红果还会继续砍分成吗无法预测具体政策。趋势上平台在从保底补贴转向纯分成万播单价和产能爆发直接相关。2D/3D动画漫剧系数目前没被砍但仿真人剧从60砍到40是前车之鉴。应对方式是控制成本结构让低万播单价下也能覆盖成本。写在最后这篇文章记录的是我从API迁移到本地部署的过程不是选型指南。核心发现是万播5元的环境下API路线的视频生成费用已经压不过分成收入本地部署的边际成本结构有本质不同。但本地部署有9万多的前期投入能不能回本取决于你的产能和内容质量不是装好机器就一定能赚钱。