AI HOT 日报 · 2026-09-22

2026-09-22 AI HOT 日报:共 15 条 AI 圈要闻,覆盖模型发布/更新、产品发布/更新、行业动态、技巧与观点,聚焦大模型发布、AI 产品更新与行业动态,每日更新。 📚 查看全部日报

模型发布/更新

  1. 小米发布并开源 MiMo-V2.6 系列,扩展强化学习规模迈向自我提升 — 公众号:小米 MiMo Xiaomi MiMo 于今日正式发布并开源 MiMo-V2.6 系列模型,包含 Pro 与 Flash 两个原生全模态模型,称这是探索 RSI(递归自我改进)路径的关键一步。 https://aihot.news/items/cmubpn8sw05u5ro4vlvacy22d

  2. xAI 发布 Grok 4.7,主打编码与知识工作 — xAI:News(网页) xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。 https://aihot.news/items/cmubfarpy0xtirolnplntl9p1

  3. 小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型 — X:小米 MiMo (@XiaomiMiMo) 小米 MiMo 发布 MiMo-V2.6 Pro 与 Flash 两个全模态模型,通过规模化强化学习训练。Pro 在多数 Agent 基准上与 Claude Opus 5 和 GPT-5.6 Sol 表现相当,在 Artificial Analysis Intelligence Index 得分 46,为开源模型中最高;能力覆盖编码、computer use、3D 推理和创作。 https://aihot.news/items/cmubqsb9l03vbrociqf22sr07

  4. 小米发布开放权重模型 MiMo-V2.6-Pro,登顶 Artificial Analysis 开放权重模型智能指数 — X:Clément Delangue(Hugging Face CEO) (@ClementDelangue) 小米(Xiaomi)发布开放权重模型 MiMo-V2.6-Pro,在 Artificial Analysis Intelligence Index 得分 46,超越前代 MiMo-V2.5-Pro 的 26,为开放权重模型中最高。 https://aihot.news/items/cmubqsb9b03v9rocigei56crg

  5. 通义千问发布 Qwen-Image-2.1:7B 单检查点同时支持图像生成与编辑 — X:通义千问 / Qwen (@Alibaba_Qwen) 通义千问发布 Qwen-Image-2.1,一个 7B 参数的原生图像生成与编辑模型,生成和编辑共用单一检查点,最多支持 10 张参考图。模型自带提示词增强 LLM,已集成 diffusers 和 ComfyUI,并在 Hugging Face Spaces 提供免安装的浏览器在线 demo:https://huggingface.co/spaces/hugging-apps/qwen-image-2-1 https://aihot.news/items/cmuao05at0q8uro5tpc85e2kj

  6. 小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3 — X:Arena (@arena) 小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。 https://aihot.news/items/cmubr2enk04a1rociadivcsjt

产品发布/更新

  1. Kimi 发布 Kimi Code Desktop 1.0,macOS 与 Windows 版同步上线 — 公众号:月之暗面(Kimi) Kimi(月之暗面)发布 Kimi Code Desktop 1.0,作为 Kimi Code 官方桌面客户端,macOS(Apple 与 Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。 https://aihot.news/items/cmuaytowf0c4oroln02tacq0c

行业动态

  1. 不列颠哥伦比亚省起诉 OpenAI,指其未在枪击案前将 flagged ChatGPT 活动转介警方 — X:Rohan Paul (@rohanpaul_ai) 不列颠哥伦比亚省在加州起诉 OpenAI,指 flagged 的 ChatGPT 活动本应在 2026 年 2 月 10 日 Tumbler Ridge 枪击案前通报警方,该案致 8 人死亡(含 5 名儿童和一名教育工作者)、27 人受伤。 https://aihot.news/items/cmubom7qi04k8ro4v1zoas2o7

  2. 亚马逊封禁 Meta Muse 智能体代用户购物,双方争端升级 — IT之家(RSS) 亚马逊阻断了 Meta 个人 AI 智能体 Muse 代用户在其网站购物的访问权限,称从未许可该访问,并指 Muse 不表明身份、会采集保存用户账号凭证,带来隐私和安全隐患。 https://aihot.news/items/cmub7xf1o0pu2roln165i6mhu

技巧与观点

  1. 马斯克称 Grok 4.7 使 xAI 在智能体编码领域位列第三 — X:Elon Musk (@elonmusk, xAI) Elon Musk 引用 Artificial Analysis 评测称,Grok 4.7 使 xAI 在智能体编码上排名第三,仅次于 Anthropic 和 OpenAI。 https://aihot.news/items/cmubi4zxl110orolnqaltv0qp

  2. Nathan Lambert 撰文分析开源模型的中美实力格局 — Nathan Lambert:Interconnects(RSS) Nathan Lambert 发布其向美国国会汇报的开源模型现状综述,指出中国开源权重模型已在下载量、基准成绩和学术采用上领先,自 2025 年 7 月起在 Hugging Face 下载量上领先约 1.6B(总 3.2B,为美国两倍)。 https://aihot.news/items/cmub7xfbe0putrolnfkkepe2c

  3. Artificial Analysis 评测 Grok 4.7:智能体知识工作跻身前沿,编码代理得分升至 56 — Artificial Analysis 完整文章(网页) Artificial Analysis 发布 Grok 4.7 评测,该模型在 Intelligence Index 得 46 分,较 Grok 4.6 高 2 分,AA-Briefcase 得 1657 Elo(+111),仅次于 Claude Opus 5 和 Claude Fable 5.1。 https://aihot.news/items/cmubni6yr03ihro4v6pea4amm

  4. 数字生命卡兹克访谈汉化组:AI 时代字幕组与漫画组的真实处境 — 公众号:数字生命卡兹克 作者访谈多位字幕组与漫画汉化组成员,发现他们并不抵触AI。Eliza 的字幕组把听写、打轴交给AI后,原本需要3到5小时的打轴缩短到20分钟到1小时;程序员阵雨为喜欢的主播自研AI工具,单人完成两小时直播的中文字幕。漫画汉化组则因嵌字质量等原因仍坚持人工制作,成员看重的是同好社群与爱好本身。 https://aihot.news/items/cmualyqxc0nztro5tbldva2bh

  5. Tomer Tunguz 谈 AI 优化 if-then 判断:专用决策器把分类成本降近百倍 — Tomer Tunguz 博客(VC 分析) Tomer Tunguz 撰文提出最新一波 AI 正在接管软件中的 if-then 判断原语,Jev 与 SemIf 这类专用决策器以数百毫秒返回结果,成本比传统生成式调用低约 76x 到 209x。作者在自己的 Agent 中替换了约四分之一的调用,在 98 条人工核验的生产邮件线程上,Jev 达到 80%、本地 SemIf 达到 82% 的分类准确率,高于生产模型的 47%。 https://aihot.news/items/cmubhvftd10qjrolnr7q9k3lt

  6. Linear 重构 CI 流程应对 AI 编码带来的验证瓶颈,PR 等待时间从 6 分钟降至 5 分钟 — Linear:Now(RSS) Linear 工程师分享如何解决 AI Agent 加速写代码后 CI 成为瓶颈的问题,PR 等待时间从 6 分钟以上降至 5 分钟出头,单测 runner 时间约减半。 https://aihot.news/items/cmublfs5a03bcro0lebbtf8fb

补充视野 · Horizon

来源:Horizon Daily(Thysrael 的 AI 聚合日摘)· 已与 AI HOT 去重,仅保留 AI HOT 未覆盖的条目

  1. Cloudflare Python Workers 结束预览正式可用 — Horizon 评分 8.0/10 · 科技新闻 Cloudflare 宣布其 Workers 平台的 Python 支持在约两年预览后正式可用(GA),称 Python 现为 Cloudflare Developer Platform 上的一等、完全受支持的语言。该运行时通过 WebAssembly 上的 Pyodide 执行 Python,并借助 JSPI 让 Requests 等 HTTP 客户端直接走 JavaScript 的 fetch API;Cloudflare 表示相关上游贡献已使这些客户端能在 WebAssembly 环境中正常路由请求。Pyodide/Emscripten 支持已通过 PEP 783 标准化,但实际性能与兼容性仍取决于具体运行时实现。 https://blog.cloudflare.com/python-workers-ga/

  2. 小米发布 MiMo v2.6,公开训练看板与技术报告 — Horizon 评分 7.0/10 · 科技新闻 小米发布大语言模型 MiMo v2.6,并在此次发布中罕见地公开了训练细节:除技术报告外,还提供了训练期间的实时 RL 看板(mimo.xiaomi.com/rl/),分析摘要将其评价为透明度突出的做法。评论者提到可通过 API 调用 Pro 与 Flash 两个版本以及 none/low/medium/high 等档位,但 medium/high 档位会消耗大量 token 并导致请求超时,尚不清楚这是 API 故障还是模型本身 token 效率偏低。由于该条目没有可用的官方页面正文,模型规模、基准成绩、价格与正式可用范围等信息无法从现有材料确认。 https://mimo.xiaomi.com/mimo-v2-6

  3. 《What Sun got wrong》:Sun 失败复盘引发讨论 — Horizon 评分 7.0/10 · 科技新闻 系统技术博客 bcantrill.dtrace.org 发表了题为《What Sun got wrong》的回顾文章,分析 Sun Microsystems 的失败及其对技术行业的教训,并在 Hacker News 上引发大量评论。根据可获取的信息,这是一篇历史与行业分析,而非产品发布或突发事件,因此不属于即时新闻。本次材料未包含文章正文,仅有标题、标签与用户讨论内容,故下文所述具体论点主要来自评论者,而非文章本身。 https://bcantrill.dtrace.org/2026/09/20/what-sun-got-wrong/

  4. xAI 发布 Grok 4.7:增量升级引发性能与定价争论 — Horizon 评分 7.0/10 · 科技新闻 xAI 发布了 Grok 4.7,这是继 Grok 4.6 之后的一次前沿模型点版本更新。条目未提供官方发布说明,因此模型能力、上下文长度、许可与可用性等细节均无法核实;Hacker News 评论者转述称,4.7 的权重比 4.6 多约 40%,而输入 2 美元、输出 6 美元的定价保持不变。多名评论者将此次发布视为增量升级:有人报告 4.7 比 4.6 更慢、更贵,也有人认为 xAI 的发布节奏正在加快,并预期年内会出现 Grok 5。 https://x.ai/news/grok-4-7

  5. FAA 称光纤被切断,美国东海岸多个机场航班暂停 — Horizon 评分 7.0/10 · 科技新闻 根据 2026 年 9 月 21 日发布的路透社报道,美国东海岸多个繁忙机场的部分航班被暂停,美国联邦航空管理局(FAA)将原因指向通信问题,并称一条光纤线路被切断。现有可核验的信息未说明受影响的机场具体名单、停飞航班数量、持续时间或恢复时间,也未说明备用线路的状态。这是一次已发生的运行中断,而非仅宣布的计划。 https://www.reuters.com/world/us/faa-halts-some-us-east-coast-flights-due-communication-issues-2026-09-21/

  6. TypeSafe AI 发布 Jev:返回类型化概率决策的决策模型 — Horizon 评分 7.0/10 · 科技新闻 TypeSafe AI 发布了 Jev,这是其称为“System One 模型”(Simon Willison 等人更倾向称为“决策模型”)的首个示例:它接受文本输入,但不生成文本,而是返回类型化概率输出——0 到 1 之间的置信度(即其称为 Noul 的伯努利式是非问题)、各选项上的概率分布(选择问题)以及数值评分(评分问题)。Jev 的 API 只按输入 token 计费、输出免费,首个模型输入价格为每百万 token 0.042 美元,低于 OpenAI GPT-5 Nano 的 0.05 美元,并且对同一份 state 提交的多个问题会并行评估。需要说明的是,目前信息来自厂商发布和 Simon Willison 的体验文章,尚无模型架构、公开基准或独立验证,具体的可用范围也未在材料中说明。 https://simonwillison.net/2026/Sep/21/jev/

  7. AWS Bedrock 接入 Kimi K3,月之暗面与海外云厂商分成模式落地 — Horizon 评分 7.0/10 · 科技新闻 亚马逊云科技(AWS)的大模型服务平台 Amazon Bedrock 宣布接入开源大模型 Kimi K3,全球企业开发者可通过 Bedrock 直接调用该模型。据该报道,此前传闻的月之暗面与海外云厂商收入分成合作由此正式落地:云厂商在自家平台上架 Kimi 模型,并按模型调用量与月之暗面分成,月之暗面目前正与多家海外云厂商推进此类合作。报道称这是中国大模型公司首次以分成模式向全球三大云厂商输出模型能力。需要说明的是,该信息来自简讯,未披露分成比例、定价、可用区域或性能基准等细节,相关表述仍属媒体报道而非厂商的完整披露。 https://36kr.com/newsflashes/3992769217428488

  8. Dynamo-Triton 多 GPU TensorRT 推理:Cosmos 3 视频生成实测 — Horizon 评分 7.0/10 · 科技博客 「背景」 生成式 AI 的算力与显存需求已超出单 GPU 所能提供的范围,而多 GPU 加速此前很难直接变成一个可调用的推理服务。作者介绍的是 TensorRT 多设备推理(TensorRT 11.0 起正式支持)与 NVIDIA Dynamo-Triton 26.07 的集成,说明它如何弥合这一落差。 https://developer.nvidia.com/blog/simplifying-model-serving-across-multiple-gpus-with-nvidia-tensorrt-multi-device-integration-in-nvidia-dynamo-triton/

  9. 在廉价硬件上跑大模型的技术 — Horizon 评分 5.0/10 · 科技博客 「背景」 下载大模型不等于能运行:8B 模型以 16 位存权重约占 16GB,再加临时计算与 KV 缓存,32GB 内存加 8GB 显存的桌面很容易不够。作者把障碍归为容量、带宽和算力三类,并指出本地运行有隐私、离线与版本控制价值,但未必更便宜。 https://blog.bytebytego.com/p/how-to-run-a-big-model-on-cheap-hardware


数据来源:AI HOT (aihot.virxact.com) · 补充:Horizon Daily