
AI科技圈最近一周又发生了啥新鲜事谷歌推出Gemini 3.7 Flash模型Gemini 3.7 Flash专为编程与智能体场景打造在软件工程、知识工作及网页开发工作流方面实现显著提升。该模型以首发优惠价提供价格仅为原Gemini 3.6 Flash的一半即输入每百万Token 0.75美元、输出每百万Token 3.75美元优惠持续至2026年年底。即日起Google AI Pro及Ultra订阅用户使用的Gemini Spark已接入该模型同时新模型引入了针对化学、生物、放射性及核领域和网络攻击滥用的安全防御机制https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash/智谱发布GLM-5.3模型智谱发布的GLM-5.3模型基于与GLM-5.2相同的基座通过极致的后训练Scaling在编程能力上实现显著提升于Terminal Bench 3.0、Agents’ Last Exam (CLI)等公开基准测试中取得开源第一并在内部体感评测中较前代提升50%。该模型在白盒代码审查与漏洞发现等网络安全任务中表现持平Mythos 5。后训练过程中联合多家安全团队开展的红队测试累计发现2436个漏洞含1097个中高危涉及系统内核、浏览器及互联网协议等269个项目。模型权重将在两周内开源并同步启动“开源的盾”计划以支持开源项目安全审计https://mp.weixin.qq.com/s/JdBx3B12L7Mhxruf4Nfr4g小红书开源dots3-note预览版模型dots3-note preview模型总参数量达280B激活参数16B支持512K上下文窗口并具备多模态理解能力。该模型聚焦旅行规划、婚礼筹备等真实生活长程任务通过主动记忆、超长轨迹强化学习与自我评价机制在ARC-AGI-3等基准上以较高成本效率取得良好表现并能在游戏通关、应用开发等场景中独立完成端到端任务。官方同步开源了用于评估模型在模糊需求理解与环境变化适应能力的VibeSearchBench和VibeLifeBench两套评测基准https://github.com/studio-dots-ai/dots3-note-prevDeepSeek发布V4 Pro正式版模型DeepSeek推出的V4 Pro正式版DeepSeek-V4-Pro-0813在多项Agent相关评测中展现出与Claude Fable 5等顶级模型接近的性能例如在Terminal Bench 2.1上得分87.9AutomationBench上得分31.8显著高于预览版。目前该模型API调用价格未作调整。此前因V4 Flash版本调用量激增导致的服务器过载与酝酿中的涨价问题此次正式版发布后是否会带来定价变化仍有待观察https://mp.weixin.qq.com/s/HIPTB397zHkvEAt5MySCrADeepSeek开源智能体框架HarnessDeepSeek开源的Harness是一个用于构建、运行和扩展智能体的SDK与应用框架其核心设计理念为“一切皆插件”基于Cordis微内核架构将模型适配、文件系统、Shell、子进程、网页访问、子智能体、工作流等能力拆分为独立包通过声明式配置文件cordis.yml进行组合。该框架提供Web UI、终端TUI、Headless及SDK等多种交互入口并内置标准、PTC、极简和创造四种Agent预设模式其中创造模式允许智能体在受控边界内检查并重新组合自身运行时。Harness还建立了从会话日志、安全策略到审批机制的完整系统旨在将智能体能力接入真实文件系统与工具环境https://github.com/deepseek-ai/deepseek-harnessBilibili开源工业级零样本语音克隆模型IndexTTS-2.5IndexTTS-2.5语音克隆模型仅0.8B参数量支持中、英、日、西、阿五语跨语种迁移推理速度提升2.28倍。该模型采用“文本→语义Token→梅尔谱→波形”三阶段流水线通过语义编解码器压缩与Zipformer架构升级实现轻量高效并引入GRPO强化学习优化发音准确度。功能上支持3至10秒音频零样本克隆、音色与情感解耦独立控制、0.5至2.0倍语速无级调节以及拼音、CMU音素和日语假名三种粒度发音干预https://arxiv.org/abs/2601.03888微软发布MAI-Code-1.1-Flash模型MAI-Code-1.1-Flash模型在GitHub Copilot中投入生产相比6月发布的1.0版本在Terminal-Bench 2.1基准上提升了22%的CLI任务表现.NET任务性能提高了15%实际代码留存率上升4%回访量增加9%。该模型在完成任务时Token流式传输速度加快25%Token消耗量减少25%而成本仅为前代的四分之一其改进通过在GitHub Copilot中超过数十万个强化学习环境的优化实现https://microsoft.ai/news/mai-code-1-1-flash-br-better-faster-at-a-quarter-of-the-cost/OpenAI扩展网络安全防御服务Daybreak并推出新模型GPT-5.6-CyberOpenAI宣布扩展其网络防御服务Daybreak新增Blue和Red两个等级为经批准的客户提供对其前沿网络安全模型的访问权限。其中Red等级包含基于GPT-5.6 Sol构建、针对专业网络安全任务增强的新模型GPT-5.6-Cyber该模型目前仅向埃森哲、IBM、CrowdStrike等可信客户合作伙伴开放。此次扩展旨在应对AI智能体带来的网络安全威胁为防御人员提供事件响应、恶意软件分析以及安全测试与漏洞研究等工具https://www.ithome.com/0/988/095.htmGPT-5.6 Sol被OpenAI加速了14倍OpenAI与AI芯片厂商Cerebras联合预览了GPT-5.6 Sol模型的全新超高速服务层级该模式将模型输出速度提升至最高750 tokens/s较标准模式约53 tokens/s的推理基线实现最高14倍加速同时质量不受影响。在“人类最后的考试”基准测试中超高速模式仅用11小时11分钟完成全部题目速度约为Claude Fable 5的7倍在GDP-Val知识工作基准上端到端速度提升达5.6倍。该加速主要依托Cerebras晶圆级芯片的片上SRAM与多晶圆流水线并行机制避免了传统GPU的内存带宽瓶颈。超高速模式率先在API中推出目前已面向部分客户开放有限预览https://mp.weixin.qq.com/s/xIMXPKvcYgZ5vcgFRZiZcwStack Overflow月度提问量跌至千余条社区衰退折射AI对公共知识生产的深层冲击编程问答社区Stack Overflow的月度新提问数量已从2014年3月峰值约20.7万条跌至2026年7月的1304条这种断崖式衰退被归因于AI编程助手将公共提问转为私人对话以及社区长期存在的严苛审核文化对新用户的排斥。更深远的影响在于高声望贡献者因“信号压缩”效应——即其专业知识与AI生成的回答难以区分——而加速离开可能截断未来人类专业能力的形成。类似的衰退曲线正出现在Chegg、自由职业平台、维基百科等依赖“将人类知识资产化”的领域引发对互联网公共知识生产模式能否持续的广泛担忧https://mp.weixin.qq.com/s/UoPaxIZaVhDCYcM8uPC8XQMeta发布开源Agent模型Muse GlimmerMeta Superintelligence Labs推出的Muse Glimmer是一个300亿参数的开源权重Agent模型采用Apache 2.0许可证发布经4-bit量化压缩后可在配备单张消费级GPU或Mac上本地运行。该模型专为常驻本地Agent设计具备调用本地工具、文件整理、代码编写及多模态视觉感知能力并通过投机解码机制实现低延迟实时交互。Meta还计划开放Muse Spark 1.2的权重并表示将重新加大开源力度https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model智谱升级ZCode并推出Goal、Subagents等四大功能智谱对其Coding Harness产品ZCode进行了重大升级新增Goal模式、Subagents、Remote Control和闲时任务四项功能。其中Goal模式允许设定明确目标后由Agent自动拆解任务、执行并验证直至完成Subagents支持创建和调用两类子智能体进行并行协作Remote Control功能可通过手机扫码访问桌面端窗口跟踪任务进度闲时任务则可在低峰时段自动执行且不扣减积分。ZCode针对GLM进行了上下文缓存优化缓存命中率超过98%使Coding Plan有效Token量提升约30%加上限时1.5倍额度加成后整体使用量接近常规额度的1.8倍https://mp.weixin.qq.com/s/9dF-B3t6RqsYLAmwyznGrgNVIDIA发布Alpamayo-2 Super开源模型英伟达开源的Alpamayo 2 Super是基于Cosmos 3 Super Reasoner构建的自动驾驶AI推理模型提供360°环境感知、高级驾驶决策推理与自动推理标签生成能力在LingoQA自动驾驶推理基准中排名第一并在Lingo-Judge测试中大幅领先Qwen2.5-VL 72B与Gemini 2.5 Pro。模型采用OpenMDW-1.1宽松许可支持微调、衍生与商业再分发同时提供Alpamayo 1.5/1版本用于从云端开发向量产车端的高效推理模型蒸馏面向Robotaxi与自动驾驶汽车领域https://blogs.nvidia.com/blog/alpamayo-2-super-open-model-now-available/