AI HOT 日报 · 2026-09-12

2026-09-12 AI HOT 日报:共 6 条 AI 圈要闻,覆盖论文研究、技巧与观点,聚焦大模型发布、AI 产品更新与行业动态,每日更新。 📚 查看全部日报

论文研究

  1. Anthropic 威胁报告披露 Claude 被用于间谍软件、导弹与无人机研发,中国实验室大规模蒸馏提取数据 — The Decoder:AI News(RSS) Anthropic 发布威胁情报报告,记录 2025 年 12 月至 2026 年 8 月间 Claude 被滥用的七类行为。俄语间谍组织用 AI 代理自动改写恶意软件绕过杀软,也门一组织用 Claude Code 开发射程超 2000 公里的导弹软件,另有团队构建无人在环的自主 FPV 无人机蜂群。 https://aihot.news/items/cmtx0v3dg030mroedwvkdfyvw

技巧与观点

  1. 实测 DeepSeek V4.1 Flash:价格大降、原生带视觉,作者用游戏与城市生成任务验证表现 — 公众号:卡尔的AI沃茨 作者实测 DeepSeek V4.1 Flash,缓存命中输入降价 7 倍多、输出砍三分之二,9 月 14 日中午 12 点起所有发往 v4-pro 的请求将被强制路由到 4.1 Flash 并按其低价计费。 https://aihot.news/items/cmtwsc5gt09uarow7n2r2jrz3

  2. Beren Millidge、John Schulman、Charlie O’Neill 对谈递归自我改进离我们还有多远 — Dwarkesh Patel:Podcast & Blog(RSS) Dwarkesh Patel 与 Zyphra CTO Beren Millidge、Thinking Machines 首席科学家 John Schulman、Baseten 模型训练负责人 Charlie O’Neill 三位研究者对谈递归自我改进(RSI)的前景。 https://aihot.news/items/cmtx7e9sn09mmroedph6hkyx4

  3. Grok Bot 摘要 SpaceX CFO Bret Johnsen 在 Goldman Sachs Communacopia 的演讲要点 — X:Elon Musk (@elonmusk, xAI) Elon Musk 转发 Grok Bot 对 SpaceX CFO Bret Johnsen 在 Goldman Sachs Communacopia 演讲的摘要。 https://aihot.news/items/cmtw9fws408trrolkp9glkz9j

  4. GitHub 日韩营销负责人如何用 GitHub Copilot 把活动运营自动化 — GitHub Blog GitHub 日韩地区营销负责人 Tomoko Tanaka 分享如何不写代码,把活动运营交给 GitHub Copilot 自动化。 https://aihot.news/items/cmtxbm8dp037xrouueja171wr

  5. OpenAI 详解存储平台 Habitat 如何扩展支撑超 10 亿 ChatGPT 用户(上篇) — OpenAI:官网动态(RSS · 排除企业/客户案例) OpenAI 发文(系列上篇)讲述其在线存储平台 Habitat 的演进:现每秒处理超 7000 万请求、服务每周超 10 亿用户、管理超 500PB 数据,覆盖近 40 个地区。 https://aihot.news/items/cmtx7f9mi09psroed4b1w3nsv

补充视野 · Horizon

来源:Horizon Daily(Thysrael 的 AI 聚合日摘)· 已与 AI HOT 去重,仅保留 AI HOT 未覆盖的条目

  1. GitLab 紧急修复 CVSS 10.0 未授权任意文件读取漏洞 — Horizon 评分 8.0/10 · 科技新闻 GitLab 于 9 月 10 日发布 19.3.2、19.2.6 和 19.1.8 三个分支的紧急补丁,修复编号为 CVE-2026-85706 的漏洞,官方给出的 CVSS 评分为满分 10.0。该漏洞源于代码仓库 commits API 的路径约束与认证缺陷,在特定条件下未认证用户可读取 GitLab 服务器上的任意文件。受影响范围包括 18.7 至 19.1.8 之前的版本、19.2.6 之前的 19.2 版本,以及 19.3.2 之前的 19.3 版本。GitLab 强烈建议自建实例立即升级至对应修复版本,GitLab.com 已完成修复,GitLab Dedicated 用户无需操作。该漏洞由研究员 s3ntago 通过 HackerOne 报告,官方尚未公开具体利用前置条件,网上也没有可复现的公开 PoC,暂无证据表明该漏洞已遭在野利用。 https://docs.gitlab.com/releases/patches/patch-release-gitlab-19-3-2-released/

  2. 陶哲轩谈 AI 与数学界的严重错位 — Horizon 评分 7.0/10 · 科技新闻 2026 年 9 月 11 日,数学家陶哲轩(Terry Tao)发表博文《A severe misalignment of AI in mathematics》,讨论 AI 与数学研究之间的严重错位;《经济学人》同日刊出《顶尖数学家对 OpenAI 的做法感到愤怒》,报道相关争议,Hacker News 上的讨论帖将两者并列并引发大量评论。争议焦点并非 AI 能否解决数学难题,而是 AI 产生结果的方式如何冲击数学界分配学术 credit 的惯例,以及数学家通过彼此理解与交流来积累知识这一传统。评论者对后果判断不一:有人以望月新一与其 abc 猜想为例,指出即便出现难以理解的巨型证明,社区仍会通过会议、论文与讨论逐步消化。另有观点认为,这些难题已悬置数十年,即便阻止 AI 实验室发布证明,普通用户迟早也能通过通用模型得到结果,因此限制发布意义有限。需要说明的是,本条目的可见内容主要是该讨论串及所链接的两篇文章,未包含两篇原文的完整论证细节。 https://mathandai.org/

  3. Simon Willison 推荐 Python 猴子补丁库 wrapture — Horizon 评分 7.0/10 · 科技新闻 Simon Willison 在其博客中推荐 Graham Dumpleton 的新 Python 猴子补丁库 wrapture,称其正逐渐成为 Python 开发者不可或缺的工具,并惊讶于外界关注之少。wrapture 于 8 月 31 日首次发布,可同时服务于测试与可观测性(类似 New Relic 风格的追踪),此后 Dumpleton 几乎每天发布一篇教程。教程内容涵盖用它完成 unittest.mock 式的单元测试、将方法调用记录为时间线并以树形结构处理与展示、安排被补丁方法在多次调用中改变行为,以及对属性、字典和生成器进行猴子补丁。教程还涉及实时追踪应用、通过独立的 TOML 文件实现零代码追踪、记录单次与聚合的耗时以定位慢代码,以及将追踪导出到 OpenTelemetry;配套的 wrapture-instrumentation 包为 Flask 应用及 aiohttp.client、aiohttp.web、django、fastapi、flask、grpc、http.client、httpx、jinja2、requests、sqlalchemy、sqlite3、starlette、urllib.request、urllib3、uvicorn、werkzeug.serving、wsgiref.simple_server、xmlrpc.client、xmlrpc.server 提供插桩。Willison 指出 wrapture 仍是 alpha 软件但已相当可用,尤其因为可以只通过 TOML 文件配置、完全不修改 Python 代码就试用;此外还有一套以 JupyterLab notebook 实现的交互式工作坊。 https://simonwillison.net/2026/Sep/11/wrapture/

  4. LLM 辅助的 Linux 内核构建加速补丁系列 — Horizon 评分 7.0/10 · 科技新闻 内核开发者 Lorenzo Stoakes 发布了一个 23 部分的补丁系列,用于显著加快 Linux 内核的构建速度;据其封面信中的总结,allmodconfig 构建最多快 36%,增量构建最多快约 70%,noop 构建最多快约 90%。他借助 LLM 先定位构建瓶颈、再寻找改进办法,但表示 LLM 生成了大量代码且“大部分很丑”,因此自己进行了大量审计与重写,并大幅修改了提交信息、封面信和注释。补丁针对多个具体环节:kallsyms 改为记录哪些 token 出现在哪些符号中,只在其可能成功的位置尝试替换(提速 2–6%);并直接输出汇编器可用的二进制数据,替代 37MB 的汇编文件(最好情况提速 11%)。在不需要时关闭 nm 的排序、让中间链接阶段不输出重定位数据,各带来约 2% 的提升;用 kallsyms 直接读取 ELF 取代 mksysmap 的 sed 流程,最好情况提速 12%;此外还引入 depcheck 工具以更高效地做依赖检查、缓存编译器特性探测结果、不分配 .modinfo 段、缓存对象是否属于模块的信息,以及按文件而非逐字节计算 modpost 的 MD4 哈希(最高提速 6%)。Linus Torvalds 对部分改动表示赞赏,并建议让 kallsyms 直接输出 ELF 对象以彻底绕开汇编器,同时提出陈旧的依赖检查机制或许可以干脆删除。 https://lwn.net/Articles/1093398/

  5. OpenAI 考虑放缓前沿 AI 开发 — Horizon 评分 7.0/10 · 科技新闻 据彭博社援引多名知情人士消息,OpenAI 正在考虑放缓前沿人工智能开发;首席执行官萨姆·奥尔特曼本周在全员会议上表示,公司可能与其他 AI 实验室协调放慢进度,但部分公司可能不愿配合。OpenAI 近期已因安全担忧放缓部分模型开发,并暂停某些内部 AI 训练。该公司拒绝置评,其首席科学家呼吁在建立共同安全标准前自愿放缓未来开发。相关计划仍处于考虑阶段,未获官方确认,也没有具体技术或政策细节。 https://www.bloomberg.com/news/articles/2026-09-11/openai-is-open-to-slowing-cutting-edge-ai-ceo-sam-altman-tells-staff

  6. OpenAI API 上线 GPT-Live-1 实时语音模型 — Horizon 评分 7.0/10 · 科技新闻 OpenAI 于 2026 年 9 月 10 日将 GPT‑Live‑1 上线 API,这是一个可同时听说(全双工)的实时语音模型。该模型支持自然打断、背景噪声处理、长对话以及电话语音代理场景,并可将复杂推理与工具调用交给后端模型处理。OpenAI 表示,GPT‑Live‑1 在 Full Duplex Bench 上的表现较 GPT‑Realtime‑2.1 提升 30 个百分点。API 的语音前端定价为每分钟 0.05 美元。上述信息来自一份简短的二次转述,尚未经过独立验证,相关性能数据均出自 OpenAI 自身说法。 https://openai.com/index/introducing-gpt-live-1-in-the-api/


数据来源:AI HOT (aihot.virxact.com) · 补充:Horizon Daily