
如何看懂 DeepSeek-V3 的 .safetensors 权重文件含 FP8 转 BF16 完整指南【免费下载链接】DeepSeek-V3项目地址: https://gitcode.com/GitHub_Trending/de/DeepSeek-V3你刚下完 685B 参数的 DeepSeek-V3 权重包面对一堆 .safetensors 文件不知从何下手读完这篇你能自己拆清权重包结构、看懂 FP8 块量化与权重索引再把 FP8 权重转成 BF16 直接喂给推理框架。转换 DeepSeek-V3 权重前先备好环境、磁盘与框架别急着敲命令先对照这张表自查一遍。准备项具体动作说明Python 环境克隆仓库安装inference/requirements.txt列出的依赖转换脚本inference/fp8_cast_bf16.py靠它们运行磁盘空间目标盘同时放得下约 340GB 源文件与约 680GB 产物转换期间两份权重并存目标推理框架选定 vLLM、LMDeploy 或 SGLang 之一BF16 权重转换后直接交给它加载 拆开 685B 权重包主模型 671B 加 MTP 14B整个模型检查点 685B 主模型 671B MTP 模块 14B。主模型是 MoE混合专家token 按需激活部分专家架构每个 token 只激活 37B 参数。各组件对应的权重路径和角色组件权重路径角色输入嵌入层model.embed_tokens.weight把 token【免费下载链接】DeepSeek-V3项目地址: https://gitcode.com/GitHub_Trending/de/DeepSeek-V3创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考