2026-08-17 科技周报

本期看点:2026年8月17日,AI圈上演开源与资本双重风暴。阿里首次开源Qwen-Max级2.4T参数MoE模型,DeepSeek与智谱以低价和性能双线夹击;美国这边,SpaceX收购Cursor、Anthropic冲刺万亿估值IPO,xAI和Google DeepMind连续发布新模型,前沿差距急剧缩小。同时白宫酝酿将开源模型纳入安全测试,监管天平开始倾斜。老马为你逐一拆解本周AI大事。

核心要点解构

  • 阿里开源Qwen3.8-2.4T-A95B:总参数2.4T、激活95B,原生上下文262,144 tokens可扩至1,010,000,为Qwen-Max级首次开源,SGLang/Miles提供Day-0支持;阿里开放权重模型半年下载超30亿次,超Meta(2.27亿)与谷歌(4.18亿)。
  • DeepSeek V4 Pro 0813上线硅基流动:1M上下文,三档推理强度,MIT协议,定价输入$1.32/M、输出$3.96/M、缓存命中$0.44/M,主打编码与智能体工作流。
  • 智谱发布GLM-5.3:编程能力较前代提升50%,Terminal Bench 3.0开源第一并接近Claude Fable 5,CyberGym安全测试得分84.5%,权重两周后开源。
  • xAI发布Grok 4.6:强化长时运行智能体,在Artificial Analysis Intelligence Index上追平GPT-5.6 Sol;8月12日发布,系与SpaceX合作的早期成果。
  • SpaceX正式收购Cursor:8月15日完成,Cursor将获得全球最大GPU集群,以更低价格提供更强模型。
  • Anthropic拟9-10月IPO,估值高达9650亿美元,年化收入超470亿美元,或成史上最大IPO之一;白宫拟将前沿开源模型纳入发布前安全测试。

节目口播文稿

[thoughtful] 大家好,欢迎收听《科技老马谈》科技周报,我是老马。今天是2026年8月17日。这一周,AI圈像是坐上了火箭,开源模型一个比一个大,资本动作一个比一个猛。咱们不多寒暄,直接进入正题。

[excited] 首先是最重磅的开源消息。8月13号,阿里Qwen团队正式开放了Qwen3.8-2.4T-A95B的模型权重。这个模型总参数高达2.4万亿,但采用了混合专家架构,每个Token只激活95B参数。原生上下文窗口是262,144个Token,还可以扩展到1,010,000,也就是超过100万。这是Qwen-Max级别模型头一回开源,社区直接把它看作Kimi k3的竞争对手。SGLang和Miles在发布当天就给出了Day-0支持。另外,根据Hugging Face的报告,过去六个月里,阿里开放权重模型全球下载量超过30亿次,超过了Meta的2.27亿和谷歌的4.18亿,Qwen系列已经开源了超过460个模型,衍生版本超过30万个。这波开源,阿里是真下了血本。

[pause] 紧接着,8月14号,DeepSeek V4 Pro 0813也正式上线了硅基流动。这个版本拥有100万Token的上下文窗口,提供低、高、最大三档推理强度,更侧重编码、工具调用和智能体工作流,而且依然保持了MIT开源协议。定价方面,输入每百万Token只要1.32美元,输出3.96美元,缓存命中更是低到0.44美元。同系列的Flash版本则主打速度和性价比。可以说,DeepSeek这波继续走低价路线,直接把API价格卷到了新高度。

[emphasis] 再来看国产模型的另一员大将。智谱在8月15号发布了GLM-5.3,它和GLM-5.2基于同一个基座,但通过极致的后训练Scaling提升了智能上界。编程能力相比前代提升了50%,在Terminal Bench 3.0这类公开基准上拿到了开源第一,并且接近Claude Fable 5的水平。更意外的是,它在网络安全任务上也表现抢眼,在CyberGym测试中得分84.5%,白盒代码审查的能力和Mythos 5持平。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。看来,安全能力正在成为新一代模型的标配。

[thinking] 再把目光转向美国。xAI在8月12号发布了Grok 4.6,重点强化了长时间运行的智能体能力。它在Artificial Analysis的Intelligence Index九项基准综合分上,直接追平了OpenAI的GPT-5.6 Sol。社区普遍认为,这标志着前沿模型的差距正在快速缩小。有意思的是,这次发布的背后其实有SpaceX的影子——本周三发布的Grok 4.6,正是双方合作的早期成果。

[excited] 没错,8月15号,Cursor官方宣布,公司已经被SpaceX正式收购,从4月份启动的流程终于落定。合并之后,Cursor将获得全球最大的GPU集群,用来构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的能力。这可能是AI编程工具领域有史以来最大的一次整合,想象空间巨大。

[thoughtful] 再说说资本市场的重磅消息。据多家媒体报道,Anthropic正在为IPO做准备,最快今年9月或10月初就要上市,估值高达9650亿美元,年化收入已经超过470亿美元。这很可能成为史上规模最大的IPO之一。Anthropic还计划拓展AI在医疗和生物学领域的应用,不过官方还没有公布具体的定价方案。在这个节骨眼上,他们也在淡化来自中国AI企业的竞争压力。

[pause] Google DeepMind这边也没有闲着。8月14号,他们发布了Gemini 3.7 Flash,距离3.6 Flash仅仅三周。这代模型主打编程和智能体任务,输入和输出价格分别为每百万Token 0.75美元和3.75美元,只有3.6 Flash的一半。也就是说,更强的能力,更低的成本,Google这波更新直接冲击了整个API市场。

[emphasis] 最后一条政策消息。据《Wired》报道,白宫计划修订AI政策框架,把达到“前沿”能力的开源模型也纳入发布前的安全测试范围。目前这个自愿框架只覆盖Anthropic、OpenAI等闭源模型,未来几个月预计会扩展。部分官员担心,如果强制30天测试,可能会抑制美国企业的创新。但不管怎样,开源和闭源模型的监管天平,正在悄悄倾斜。

[pause] 好了,以上是今天科技周报的全部内容。从阿里2.4万亿参数的巨型开源,到DeepSeek的低价API,再到SpaceX收购Cursor和Anthropic的万亿IPO,这周的AI圈可以说是火力全开。各位听众,你们怎么看?欢迎在评论区留言。感谢收听,我们下周见!