
文章目录1 今早AI圈直接炸锅了1.1 阿里干了件没人想到的事1.2 这可不是普通型号2 这个模型到底有多能打2.1 先看纸面参数2.2 跑分有赢有输但强项真的强2.3 最狠的是能自己干长活3 普通人能本地跑吗有骚操作3.1 原版大小一般人真扛不住3.2 已经有人搞出压缩版了4 最近大模型圈是真的卷疯了4.1 短短几天三家轮番炸场4.2 大家都在卷同一件事P.S. 无意间发现了一个巨牛的人工智能教程非常通俗易懂对AI感兴趣的朋友强烈推荐去看看 传送门https://blog.csdn.net/HHX_011 今早AI圈直接炸锅了1.1 阿里干了件没人想到的事千问团队直接把Qwen3.8-2.4T-A95B的模型权重开放了。说直白点就是把自家旗舰级的大模型原封不动放到了开源社区。这感觉就像连锁火锅店直接把锅底秘方打印出来贴大门口了。1.2 这可不是普通型号这个模型就是之前Qwen3.8-Max的基础版本本月初刚发布的旗舰款。带视觉输入、百万上下文、内置工具该有的功能全都有。以前这种级别的模型你只能按token付费调用连本地摸一下的机会都没有。这次直接放开权重属实是降维打击级别的操作。2 这个模型到底有多能打2.1 先看纸面参数总参数2.4万亿每个token激活950亿参数。原生支持26万token上下文拉满能到101万token。101万token是什么概念一整本长篇小说丢进去它能从头记到尾。换以前的模型看个长合同都得分好几段喂还经常看到后面忘前面。2.2 跑分有赢有输但强项真的强论文复现测试PaperBench拿了93分比GPT-5.6 Sol、Fable 5都高。电脑操作能力测试、参数化CAD测试也都是第一名。当然也不是全项第一终端编程、软件工程基准、长视频理解这几项还是略逊于头部对手。相当于偏科学霸数理化直接拉满文科稍微弱一点但整体还是第一梯队。2.3 最狠的是能自己干长活这次主打的就是长周期智能体能力不用人盯着它能自己把活干完。官方测了连续自主编程16天自己收集需求、写代码、修bug全程不用人插手。还能自己复现论文、打算法竞赛甚至模拟开电商公司跑了两千多轮交互。以前的AI是你问一句它答一句纯纯工具人。现在这货给个需求能自己干半个月连摸鱼划水都不会。3 普通人能本地跑吗有骚操作3.1 原版大小一般人真扛不住原始模型体积4.9TB先不说显存很多人硬盘都装不下。正常情况这种万亿参数模型只有数据中心能跑。3.2 已经有人搞出压缩版了有个团队搞了个量化技术直接把模型压到了397GB空间省了91%。只要你设备内存加显存凑够410GB以上就能本地跑起来。虽然普通游戏本还是没戏但至少工作站级别的设备能安排上了。相当于以前只有航母能开的船现在豪华游艇也能下水试试了。4 最近大模型圈是真的卷疯了4.1 短短几天三家轮番炸场先是马斯克放出Grok 4.6说性能跟顶级模型不相上下。紧接着DeepSeek V4 Pro正式版上线部分指标追平Fable 5。转头阿里就直接把旗舰模型开源了一波接一波根本停不下来。4.2 大家都在卷同一件事三家新模型不约而同都在强化智能体能力。比的不再是单道题答得对不对而是能不能独立接一整个项目自己闭环干完。以前卷参数、卷跑分现在卷“能不能自己上班”。照这个节奏下去再过两年说不定AI自己就能开公司我们反倒成了给它打工的。总得来说这次阿里把万亿级旗舰模型开源对国内开源圈绝对是个大节点。后面肯定会冒出一堆基于它的新玩法有的热闹看了。P.S. 无意间发现了一个巨牛的人工智能教程非常通俗易懂对AI感兴趣的朋友强烈推荐去看看传送门https://blog.csdn.net/HHX_01