WorkBuddy 模型与思考模式详解:Hy3 快慢思考融合 + 多模型切换 + 积分透明
WorkBuddy 模型与思考模式详解Hy3 快慢思考融合 多模型切换 积分透明摘要本文拆解 WorkBuddy 的模型与思考体系。以腾讯 2026 年 7 月发布的旗舰模型 Hy3MoE 架构、256K 上下文、快慢思考融合为核心讲清思考模式、多模型切换与积分透明三大机制并给出 models.json 配置示例与按任务选型的实战建议帮你把 AI 的「脑回路」和「花销」都握在手里。目录一、背景模型选择是 AI 办公的第一道开关二、核心概念Hy3 / 思考模式 / 多模型 / 积分透明三、实战切换模型与配置自定义模型四、进阶按任务选型与省钱技巧五、总结一、背景模型选择是 AI 办公的第一道开关用 WorkBuddy 干活第一个要做的决定往往是用哪个模型这件事之所以重要是因为模型倍率直接决定积分消耗速度。同一份工作交给高倍率旗舰模型和轻量模型处理成本可能相差数倍而不同任务对推理深度的要求又天差地别——写一句周报不需要深度推理调一个多步 Agent 工作流却非深度思考不可。WorkBuddy 把这件事做成了「可调度、可透视」的能力既能一键切换模型也能控制思考强度还能把每一次消耗的积分摊开给你看。理解这套体系是用好 WorkBuddy 的基础。二、核心概念Hy3 / 思考模式 / 多模型 / 积分透明2.1 Hy3快慢思考融合的旗舰模型Hy3 是腾讯于 2026 年 7 月 6 日正式发布的旗舰大模型在 WorkBuddy 首发上线。它的几个关键指标值得记住MoE 混合专家架构总参数 295B激活参数仅 21B用「小身板」跑出比肩参数规模 25 倍旗舰模型的水平。256K 超长上下文长文档、大代码库可以一口气吃下去做数据分析、代码开发很顺手。快慢思考融合简单问题秒回复杂任务进入深度推理兼顾速度与质量。办公场景实测相较 preview 版本端到端任务成功率由 72% 提升至 90%单任务平均耗时缩减 34%文档处理较 GLM-5.2 节省约 47.4% 的 tokenPPT 制作节省约 49.0%。定价输入 1 元/百万 tokens、输出 4 元/百万 tokens端内常有免费体验活动以当前标识为准。2.2 思考模式极速与深度两条通道WorkBuddy 把「思考」做成了可切换的模式对应 Hy3 的快慢思考融合极速模式适合简单问答、格式转换、轻量改写追求秒回。深度思考模式适合复杂推理、多步规划、代码与数据分析模型会展开推理链。工程实现上深度思考支持并行子任务WorkBuddy 在 5.3.6 版本专门修复了「深度思考并行子任务时思考文本相互覆盖」的问题并在 5.3.3 修复了思考强度档位外显异常让强度选择更稳定可见。2.3 多模型从 Auto 路由到自定义接入WorkBuddy 不绑定单一模型提供多层选择Auto 模式智能路由按任务复杂度自动调度最优模型适合不确定用哪个模型的场景。混元家族以 Hy3 为代表的腾讯自研模型性价比突出。自定义模型支持接入 DeepSeek V4、Kimi K2.6 等通过models.json配置且支持热更新修改后无需重启。切换轨迹清晰对话中切换模型会自动插入分隔线提示模型轨迹一目了然Token Plan 可切换不同计费策略。2.4 积分透明花多少、怎么花都看得见为了避免「不知不觉烧光积分」WorkBuddy 在费用侧做了多轮透明化模型倍率公示不同模型设置不同积分消耗系数能力越强系数越高。夜间折扣展示5.3.3 与 5.2.3 新增「模型夜间折扣展示」费用信息更透明。生图/生视频提示ImageGen / VideoGen 工具描述里直接标注积分消耗提醒你避开「积分刺客」视频生成最贵使用前务必确认。用量平铺展示5.2.6 把模型积分用量从 hover 隐藏改为名称与图标平铺显示随时可见。整体架构可以用下面这张图概括图模型层Auto 路由 / Hy3 / 自定义与思考模式极速 / 深度双轴叠加积分透明与多模型切换。三、实战切换模型与配置自定义模型日常使用里切换模型通常在对话输入框上方的模型列表里完成点开列表 → 选择「混元 Hy3」或「Auto」→ 选中即生效对话中切换会自动插入分隔线。如果要接入自己的模型编辑 WorkBuddy 的models.json即可修改后无需重启热更新。一个最小配置示例{models:[{id:hunyuan-hy3,name:混元 Hy3,provider:tencent,context_length:256000,thinking:true,pricing:{input:1,output:4,unit:per_million_tokens}},{id:deepseek-v4,name:DeepSeek V4,provider:deepseek,context_length:128000,thinking:true},{id:kimi-k2_6,name:Kimi K2.6,provider:moonshot,context_length:200000,thinking:false}]}写入后在模型列表里就能看到新接入的模型对积分敏感的任务优先选倍率更低的模型并在闲时利用夜间折扣。四、进阶按任务选型与省钱技巧把模型、思考模式和积分三件事组合起来可以按任务类型建立一张选型表任务类型推荐模型思考模式说明周报 / 格式转换 / 轻量改写Auto 或 Hy3极速追求速度省积分复杂推理 / 多步规划Hy3深度思考成功率与质量优先代码开发 / 大代码库Hy3256K 上下文深度思考长上下文吃得下数据分析 / 图表生成Hy3深度思考数据类任务省 token生图 / 生视频专用 ImageGen / VideoGen—留意积分提示控制频次省钱与避坑的几个建议不确定就用 Auto让路由帮你选避免手动选高倍率模型做简单活。闲时用夜间折扣对时效性不强的批量任务放到夜间跑更划算。避开积分刺客视频生成最贵且提示最弱使用前确认积分余额。长文档交给 Hy3256K 上下文一次吞下省去分段拼接的麻烦。五、总结WorkBuddy 的模型体系以Hy3MoE 295B/21B 激活、256K 上下文、快慢思考融合为核心办公场景实测成功率 72%→90%。思考模式提供极速与深度两条通道深度思考支持并行子任务相关稳定性在 5.3.6 得到修复。多模型覆盖 Auto 路由、混元家族与自定义接入DeepSeek V4 / Kimi K2.6models.json热更新免重启。积分透明通过模型倍率、夜间折扣、生图/生视频提示与用量平铺展示让花销看得见。按任务选型 闲时折扣 避开积分刺客是把成本压到最低的三件套。模型不是越贵越好而是「选得对、想得清、花得明」。把这三件事理顺WorkBuddy 才算真正为你所用。参考资料腾讯云开发者社区《WorkBuddy 大模型怎么选场景化选型指南》2026-07-10科技日报《参数做减法 智能做加法 腾讯混元 Hy3 以高性价比推动普惠》2026-07-06腾讯网《腾讯混元 Hy3 正式发布日均 Token 消耗量增长 20 倍》2026-07-06搜狐科技《记者实测 Hy3再次看到腾讯做好用模型的决心》2026-07WorkBuddy 官方更新日志workbuddy.cn 文档中心含 5.3.3 / 5.3.6 模型与思考相关条目