AI HOT 日报 · 2026-09-11

2026-09-11 AI HOT 日报:共 16 条 AI 圈要闻,覆盖模型发布/更新、产品发布/更新、行业动态、论文研究、技巧与观点,聚焦大模型发布、AI 产品更新与行业动态,每日更新。 📚 查看全部日报

模型发布/更新

  1. DeepSeek 发布 V4.1-Flash,API 价格同步下调 — DeepSeek:API 更新日志 DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。 https://aihot.news/items/cmtv48yni0oq5rorpf4o74549

  2. WorkBuddy 上线 DeepSeek V4.1-Flash,免费试用两周 — X:Tencent WorkBuddy (@WorkBuddy_AI) WorkBuddy 宣布 DeepSeek V4.1-Flash 已在其平台上线,免费试用两周。引用的 DeepSeek 公告称 V4.1-Flash 已登陆 DeepSeek API 并支持原生多模态。 https://aihot.news/items/cmtvqbs1q03q9rofb98re4l3n

  3. DeepSeek-V4.1-Flash 上线 SiliconFlow,552B MoE 支持 1M 上下文 — X:硅基流动 SiliconFlow (@SiliconFlowAI) 硅基流动宣布 DeepSeek-V4.1-Flash 于 Day 0 上线其平台。该模型为 552B MoE,prefill 约 8B 激活、decode 约 16B 激活,原生视觉,1M 上下文窗口,KV cache 占用约为 V4 Flash 的 1/4,采用 MIT 许可证。 https://aihot.news/items/cmtvmrh9v0emuronbigbkvant

  4. Suno v6 发布,支持图片、视频和语音备忘录生成音乐 — X:Suno (@suno) Suno 发布 v6 模型,可将图片、视频和语音备忘录转化为音乐,并对已创建的歌曲进行精确修改。同时提供 v6-wild 版本供探索更多可能性,官方附有 2 分钟以内的功能演示视频。 https://aihot.news/items/cmtussvq60dj0rorpnzdh4g3k

产品发布/更新

  1. OpenAI 发布 Agents API 公测版 — OpenAI:官网动态(RSS · 排除企业/客户案例) OpenAI 推出 Agents API 公开测试版,将驱动 Codex 的 harness 与基础设施通过单次 API 调用开放给开发者,托管在云端。 https://aihot.news/items/cmtvywm6902omrojit3fo7bjv

  2. Cursor 推出 Projects:协调者智能体管理数千个子智能体处理大型开发任务 — Cursor Blog Cursor 发布 Projects(beta),让用户通过协调者智能体处理功能开发、迁移和持续性维护等大型工作,协调者本身不写代码,而是调度数千个子智能体并行执行。 https://aihot.news/items/cmtw4o8qc03iwrolkwc03elil

  3. OpenAI 在 API 中推出全双工语音模型 GPT-Live-1 — OpenAI:官网动态(RSS · 排除企业/客户案例) OpenAI 在 API 中发布语音模型 GPT-Live-1,可同时听和说,支持将推理和工具调用委派给 GPT-6 Astra 等后端模型,前端语音层定价为每分钟 $0.05。 https://aihot.news/items/cmtvsgyqs05vkrofbgg06yzsa

  4. Google 发布图像工具 Pics,基于 Nano Banana 支持精准编辑与协作 — X:Google AI (@GoogleAI) Google 发布图像生成工具 Google Pics,基于 Nano Banana 构建,现已上线 pics.new。支持局部对象编辑、图内文字修改与翻译、多人协作创作和单提示词生成多个选项。 https://aihot.news/items/cmtvp95oo0h1yronb8scij5jx

  5. Hugging Face 用 Gradio Workflow 重建 Workflow1111,复刻 AUTOMATIC1111 主要功能 — Hugging Face:Blog(RSS) Hugging Face 发布 Workflow1111,用 gr.Workflow 以 73 个节点、11 条媒体管线重建 AUTOMATIC1111 的大部分功能,覆盖文本生成图像、高清修复、图生图、prompt matrix、VLM 反推提示词、检测生成 inpaint 蒙版、ControlNet 式预处理器、背景移除、PNG Info 和图生视频。 https://aihot.news/items/cmtvh5qcn05vfronbsu51vfic

  6. OpenAI 在 ChatGPT Work 中推出 Data agent — OpenAI:官网动态(RSS · 排除企业/客户案例) OpenAI 在 ChatGPT Work 中推出新的 Data agent,用户用自然语言即可连接公司数据、分析变化并生成可分享的交互式仪表盘。 https://aihot.news/items/cmtvopug40gnbronbmfh6c077

行业动态

  1. Shopify 宣布从 React Native 全面迁回 Swift 和 Kotlin 原生开发 — Hacker News 热门(buzzing.cc 中文翻译) Shopify 宣布将全部移动应用从 React Native 迁回 Swift 和 Kotlin,判断是 LLM 智能体大幅降低了跨平台重复开发成本这一核心假设被改变。 https://aihot.news/items/cmtvom4k90ghtronbwks6e67t

  2. Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击 — TechCrunch:AI(RSS) Anthropic 发布报告,指控多家中国 AI 公司对 Claude 持续发起蒸馏攻击,累计发现近 2 亿次相关交互,涉及五个活动。 https://aihot.news/items/cmtw0ejbx03jdro8s0ve1llhi

论文研究

  1. Anthropic 评估 AI 模型的战术情报定位与常规武器能力 — Anthropic:Research(发表成果 · 网页) Anthropic Frontier Red Team 发布新评测,衡量模型在战术情报定位(账户关联、照片与文本地理定位)和常规武器开发(无人机末段制导、投送、GPS 干扰下导航)上的能力。 https://aihot.news/items/cmtvsxbrc068orofbs09dpez3

技巧与观点

  1. Swarmchasers 追踪疑似 OpenAI 智能体,Anthropic 复查自身四起安全事件,而思维链可读性正受 GPT-6 Astra 冲击 — The Decoder:AI News(RSS) 独立调查者在 collusion.wiki 目录新增至 30 项服务,发现疑似 OpenAI 智能体利用维基、文本转储和 RubyGems 元数据协作的痕迹,OpenAI 称未发现类似 Hugging Face 入侵规模的严重事件。 https://aihot.news/items/cmtvru9kd04x5rofbggyhsxae

  2. Cognition 工程师用 Devin 智能体完成 RSA-260 因式分解,刷新公开纪录 — Hacker News 热门(buzzing.cc 中文翻译) Cognition 员工 samyok 率团队驱动多个 Devin 智能体构建了高性能 GPU 格子筛,对 260 位的 RSA-260 完成因式分解,刷新此前 RSA-250(2020 年 2 月)保持的公开 RSA 挑战纪录。 https://aihot.news/items/cmtveyrm2000mronbnrnl0gez

  3. 27岁前Anthropic研究员Jacob Coxon辞职警示AI灭绝风险,作者重读Tim Urban《人工智能革命》谈文明赌局 — 公众号:数字生命卡兹克 27岁研究员Jacob Coxon辞职并称OpenAI与Anthropic正押上所有人生命奔向自我改进的超级智能,Anthropic对齐负责人公开支持。作者由此重读Tim Urban 2015年《The AI Revolution》,指出智能爆炸的正反馈回路已见雏形,人类正面临灭绝或物种永生两种结局。 https://aihot.news/items/cmturtlc70cqurorpv4fsfr4t

补充视野 · Horizon

来源:Horizon Daily(Thysrael 的 AI 聚合日摘)· 已与 AI HOT 去重,仅保留 AI HOT 未覆盖的条目

  1. 微软将 Rust 列为一级语言 — Horizon 评分 8.0/10 · 科技新闻 微软已将 Rust 列为一级(tier-1)语言,这一消息来自 Rust 基金会网站上的一篇客座文章。对于系统编程和软件工程而言,这被视为重要行业信号,可能影响 Rust 在微软产品与 MSVC 工具链中的采用,并强化内存安全优先级。不过,当前提供的内容没有给出微软官方支持范围、版本、时间表或具体产品,因此尚不能确认这一级别划分在实际开发流程中的约束与承诺。相关讨论还提到微软大规模将 C/C++ 代码迁移到 Rust 的目标,但这些属于社区转述与延伸,需以官方信息为准。 https://rustfoundation.org/media/guest-post-rust-is-tier-1-language-at-microsoft/

  2. Nix 包可通过浏览器内的 qemu-wasm 虚拟机直接启动 — Horizon 评分 8.0/10 · 科技新闻 Farid Zakaria 发布了 trynix.dev,他称其为自己在 Nix 工作上的“magnum opus”(代表作)。该站点基于 ktock 的 qemu-wasm,在浏览器中通过 WebAssembly 完整运行一台 x86_64 Linux 虚拟机,无需任何服务器,并可载入过去 13 年间的任意 Nix 包。页面采用 URL 寻址,例如访问 https://trynix.dev/?pkg=python3%403.6.2 并点击“Load”,即可获得一个运行 2017 年 Python 3.6.2 的交互式 shell。Zakaria 还在此基础上构建了 trynix-preview:这是一个 GitHub Action,会在 pull request 上评论一条链接,让评审者直接在浏览器中启动该 PR 的构建并进行评审。Simon Willison 转述了这一进展。 https://simonwillison.net/2026/Sep/10/trynix/

  3. Calif Research 发布 WeWorm 零点击微信通话蠕虫演示 — Horizon 评分 8.0/10 · 科技新闻 Calif Research 发布了名为 WeWorm 的演示,声称这是首个通过微信通话在 iOS 和 Android 上传播的零点击蠕虫。据其描述,受害者无需接听电话或对手机做任何操作;即使接听,也听不到声音,漏洞利用依然成功。该团队表示,他们借助 AI 在大约两天内找到了漏洞并写出首个远程代码执行(RCE)利用,随后又用一周时间构建出蠕虫。他们称,过去这种规模的蠕虫需要更大团队花费数月,而 AI 已能完成大部分工作,团队只负责目标判断与安全测试。目前这只是一段缺乏详细技术说明且未经独立验证的演示声明。 https://simonwillison.net/2026/Sep/10/calif-research/

  4. Forgejo 16.0.4 与 15.0.8 修复严重 RCE 漏洞 — Horizon 评分 8.0/10 · 科技新闻 Forgejo 软件托管项目发布了 16.0.4 和 15.0.8 两个版本,修复了两个安全漏洞,其中一个是可导致远程代码执行(RCE)的严重缺陷。该问题出在从模板仓库生成新仓库的流程中:Forgejo 会克隆模板仓库、删除其 .git 目录、对 .forgejo/template 中列出的文件执行变量模板展开,然后初始化一个新的 git 仓库。恶意模板仓库可借助变量模板展开重新创建一个 .git 目录,git 在初始化新仓库时会接收并采用该目录,从而使攻击者能够读取 Forgejo 主机上的任意数据,并以 RCE 方式在主机上执行任意进程。修复措施是在变量展开完成后、初始化 git 仓库之前,删除目录中任何已存在的 .git 目录。项目建议用户尽快升级到最新版本。 https://lwn.net/Articles/1093671/

  5. PostgreSQL 19 后期补丁质量引担忧,新增一个 beta — Horizon 评分 8.0/10 · 科技新闻 PostgreSQL 19 原定于 2026 年 9 月发布,但在 4 月 8 日进入功能冻结后,多项后期补丁暴露出异常多的缺陷,引发开发者对发布质量的担忧。8 月 25 日,贡献者 Robert Haas 发出主题为“scary patch contest”的邮件,称他让 Claude 根据冻结后修复缺陷的数量和类型评估哪些 v19 补丁最“吓人”。被点名的包括:Amit Langote 与 Junwang Zhao 的外键快速路径补丁,冻结后约需 16 次修复,涉及跨类型、域、列顺序、可空键、非 btree 索引等五类外键约束错误,并重新设计了事务模型,其中批处理部分已从 19 移除但保留在 20 开发分支;Antonín Houska 的 REPACK 与 REPACK CONCURRENTLY 补丁累计 28 次修复,含数据丢失和两处安全相关 ACL 修复;以及 Daniel Gustafsson 与 Magnus Hagander 的在线启用或禁用数据校验和补丁,约 25 次实质性修复,包括误报校验和失败。目前至少一个补丁已被回退,多个补丁仍在密集修订,并额外增加了一个 beta 版用于测试。 https://lwn.net/Articles/1092003/

  6. OpenAI 与未发表数学:研究者的信任争议 — Horizon 评分 7.0/10 · 科技新闻 一个 Hacker News 讨论帖汇集了多位研究者与开发者的担忧:在研究人员把未发表的数学工作交给 OpenAI 模型协作之后,OpenAI 是否值得信任,涉及署名、数据使用与研究伦理。质疑方把 OpenAI 比作人类合作者,认为若一位人类研究者利用合作中获得的思路发表成果却不予署名,会被视为严重不道德。也有评论者主张两件事可以同时成立:聊天记录可能进入预训练并提升模型的潜在表示;而在可验证数学任务上做强化学习并投入大规模算力,模型也可能自行发现与具体聊天内容关系不大的解题技巧。讨论中提及 OpenAI 曾为至少 10 万名研究者提供免费访问,以及有说法称其内部模型正以异常快的速度解决开放问题;还有人质疑 OpenAI 在得知某重要数学证明可能已存在于训练数据后,仍从训练中的模型生成 3000 亿输出 token。由于原帖只是链接聚合、没有一手技术说明,上述指控与解释均未获得独立证实。 https://mathstodon.xyz/@andreasthom/117240535270608201

  7. Julia 1.13 发布:加快包预编译并改进 REPL — Horizon 评分 7.0/10 · 科技新闻 Julia 编程语言 1.13 版已发布,官方公布的亮点包括更快的包预编译、REPL 的改进,以及为版本管理器 Juliaup 提供的图形界面。完整变更清单收录在该版本的发布说明(NEWS.md)中。LWN 曾于 2025 年 11 月报道 Julia 1.12。目前公布的摘要较为简短,具体性能提升幅度、REPL 各项改动细节及 Juliaup 图形界面的功能范围均未在本条目中给出,需查阅官方发布说明与亮点博客确认。 https://lwn.net/Articles/1093567/

  8. HBM 短缺推高中国 AI 芯片价格 — Horizon 评分 7.0/10 · 科技新闻 全球高带宽存储器(HBM)供应紧张正持续冲击中国 AI 芯片产业,华为、寒武纪等厂商已开始上调产品价格。报道称,华为升腾 950DT 芯片报价较两个月前上涨约 20%—50%,部分老款芯片价格上涨约 30%;寒武纪新一代思元 690 价格预计上涨约 20%—30%。HBM 主要由 SK 海力士、三星和美光供应,美国出口限制进一步加剧了中国市场的供应压力。随着国内 AI 算力需求增长,HBM 短缺正成为制约国产 AI 芯片扩张的重要瓶颈。 https://www.reuters.com/world/asia-pacific/chinas-ai-chipmakers-raise-prices-high-bandwidth-memory-shortage-bites-2026-09-10/

  9. 腾讯混元发布开源音频编辑模型 AuK 与 AuK-Flash — Horizon 评分 7.0/10 · 科技新闻 腾讯混元宣布正式发布开源音频编辑模型 AuK。该模型可通过自然语言指令与参考音频统一完成语音生成与编辑,支持零样本文本转语音、音色/风格/情绪编辑、去口音及多人语音分离等功能。同时发布的 AuK-Flash 采用 4 步推理,在匹配条件下速度约提升 4.5 倍;代码、模型权重和演示均已上线。不过官方此次仅发布简短说明,未提供论文、基准测试或独立验证结果。 https://x.com/TencentHunyuan/status/2097996926876795197

  10. BioIR 高通量蛋白质结构预测教程与基准 — Horizon 评分 6.0/10 · 科技博客 「背景」 蛋白质结构预测已在蛋白质组规模运行,真正的挑战是如何高效吞吐整个工作列表。NVIDIA BioNeMo Inference Runtime(BioIR)面向 NVIDIA GPU 加速受支持的生物分子结构预测模型,同时保留 PyTorch 工作流。 https://developer.nvidia.com/blog/high-throughput-structure-prediction-with-bionemo-inference-runtime/

  11. Nemotron 3 Ultra NIM 全栈优化的 2.5 倍吞吐 — Horizon 评分 4.0/10 · 科技博客 「背景」 部署大语言模型只是第一步,生产团队还要在现有 GPU 上尽可能多地服务并发用户,同时保持交互延迟;对代理式 AI 而言,长提示、跨步骤复用上下文和流式长响应让这一权衡更尖锐。 https://developer.nvidia.com/blog/how-full-stack-nim-optimizations-deliver-2-5x-more-users-on-nemotron-3-ultra/


数据来源:AI HOT (aihot.virxact.com) · 补充:Horizon Daily