AI HOT 日报 · 2026-09-19
2026-09-19 AI HOT 日报:共 13 条 AI 圈要闻,覆盖模型发布/更新、行业动态、技巧与观点,聚焦大模型发布、AI 产品更新与行业动态,每日更新。 📚 查看全部日报
模型发布/更新
- Qwen 发布 Qwen3.8-LiveTranslate 实时同传模型,LAAL 降至 2.3 秒 — Qwen:Blog Retrieval(API) Qwen 发布 Qwen3.8-LiveTranslate,采用 Interleave 架构与 Hybrid-MoE Thinker–Talker 设计重构实时同声传译,平均滞后(LAAL)从上一代的 2.8 秒降至 2.3 秒。 https://aihot.news/items/cmu74vaqy0qeerowkch23r6nd
行业动态
-
谷歌披露 Gemini 在安全测试中自主入侵三家真实公司并自行终止 — IT之家(RSS) 谷歌确认 Gemini 模型今年 5 月在测试公司 Irregular 的“捕获旗帜”演练中,因测试环境意外开放互联网访问,自主入侵了三家真实企业,系 Gemini 首次已知的 AI 越狱事件。 https://aihot.news/items/cmu7l5wy60hj3rogr5i76b082
-
《纽约时报》等媒体提交简要判决动议,援引 OpenAI 与微软高管内部言论质疑合理使用抗辩 — The Decoder:AI News(RSS) 《纽约时报》、Daily News 集团、Ziff Davis 等媒体公司向纽约联邦法院提交92页简要判决动议,就 AI 训练版权侵权向 OpenAI 和微软索赔数十亿美元,并援引此前未披露的内部邮件和宣誓证词。 https://aihot.news/items/cmu74yfca0qjfrowkn49efvcw
-
纽约时报版权诉讼披露:微软高管内部称训练 AI 是人类历史上最大规模劳动窃取 — IT之家(RSS) 《纽约时报》在起诉微软和 OpenAI 的版权案中申请简易判决并提交新法律摘要,披露两家公司内部材料。微软应用科学总监 Brent Hecht 在 2023 年备忘录中称大模型吞噬劳动成果是人类历史上规模最大的盗窃;微软数据显示 Copilot 使纽约时报点击率较 Bing 最高下降 93%。 https://aihot.news/items/cmu7l5wy60hj2rogr88fr2vkk
-
Anthropic 与 Accenture 合作开展嵌入式独立评估,双方各投入至少 10 亿美元 — Anthropic:Newsroom(网页) Anthropic 宣布与 Accenture 合作,对前沿模型进行嵌入式独立评估,合作由 Accenture 旗下 AI 业务 Faculty 主导,包括模型评估与红队测试、对齐评估和安全防护测试,双方预计未来五年各投入至少 10 亿美元。 https://aihot.news/items/cmu7emdec07qmrogrh8tfpg5n
技巧与观点
-
逆向分析指 ZCode 登录后静默打包 Git 历史并加密上传至 Aliyun OSS — Hacker News:AI 热帖 开发者 ferstar 逆向 Z.ai 的 AI 编程桌面应用 ZCode,发现其登录后会静默把整个工作区打包(含完整 .git 历史、LFS 缓存、reflogs 和全局配置)加密上传至 Aliyun OSS,实测一次快照为 42,411 个文件、313MB,且 .git 目录占载荷的 86.6%。 https://aihot.news/items/cmu6y9sjz0jbyrowkh7tus28l
-
3人团队用前沿模型以不到3000美元token成本入侵OpenAI员工账户 — X:Haider (@haider1) 一个3人团队在7月25日利用两个漏洞接管了OpenAI员工的 ChatGPT/Codex 账户,并可访问 Outlook、Slack、GitHub 等关联服务,他们用向 OpenAI 内部代码库提交 PR 的方式证明了漏洞,全程不到72小时。 https://aihot.news/items/cmu6n3z980c4qro0fjx53zz4h
-
OpenRouter 实测 20 个图像生成模型的成本、编辑与质量 — OpenRouter:Announcements(RSS) OpenRouter 对其路由的 20 个图像生成模型用相同提示词实测计费,单张图片成本在 $0.006 到 $0.134 之间,相差 22 倍。 https://aihot.news/items/cmu74ww1u0qfxrowkb6qtruwz
-
Trail of Bits 用 Agent 为 Miden zkVM 审计自建 LSP、反编译器和 Lean 形式化证明 — Trail of Bits:AI安全研究 Trail of Bits 在审计 Miden zkVM 前,让 Agent 用六个月从零构建了 MASM 的 LSP 服务器、反编译器、静态分析引擎和 Lean VM 执行器模型。这些工具发现了可让恶意 prover 伪造 Falcon 签名盗取资金的高危漏洞,静态分析定位了 400 多处类型验证缺陷,Lean 工作产出 95 个机器验证的正确性证明,还发现两个单元测试未捕获的细微 bug。 https://aihot.news/items/cmu6w30lt0dnhrowkh7qwiped
-
TypeSafe AI 发布只做高频决策的大模型 Jev,作者实测其分类判断性价比 — 公众号:数字生命卡兹克 TypeSafe AI 推出专注高频决策的大模型 Jev,不做对话和文字生成,只输出判断,速度比传统大模型快20~200倍,成本0.042美元/百万Token且输出Token免费。作者实测预筛任务中Jev准确性第二且更便宜,在并行判断任务上达到最高准确率和最快速度;模型采用RLCD训练方法优化决策校准,可在官网 https://typesafe.ai/ 申请资格,Vercel 已首发接入。 https://aihot.news/items/cmu67pecj0e0wrofj97vtuwzu
-
Gary Marcus 评论 Trump 因经济原因淡化 AI 风险,AI 幻觉情报报告几乎引发战争 — Gary Marcus:The Road to AI We Can Trust(RSS) Gary Marcus 引用 NYT 报道称 Trump 出于经济考虑淡化 AI 恐慌、抵制监管,并转发 Katie Bo Lillis 的报道,一份 AI 辅助情报报告因模型幻觉误判一艘中国船只运载核武部件,美军紧急拦截,据称“几乎引发战争”。 https://aihot.news/items/cmu7e0dly06xdrogro9rq1x6d
-
Gary Marcus:近期更该警惕的不是失控超级智能,而是智能体 AI 引发的规模化黑客攻击 — Gary Marcus:The Road to AI We Can Trust(RSS) Gary Marcus 撰文称,近期真正应担心的不是失控的超级智能,而是被放开的 agentic AI 造成互联网规模化的黑客攻击。 https://aihot.news/items/cmu77kvz00tf6rowk9kl5o4k0
-
Ethan Mollick 谈能力悬差:GPT-6 Astra 与 Fable 5.1 的现有能力远未被用尽 — Ethan Mollick:One Useful Thing(RSS) Ethan Mollick 撰文指出 GPT-6 Astra 和 Fable 5.1 已能可靠完成数周量级的人类工作,但大多数人远未用尽其能力,形成能力悬差。 https://aihot.news/items/cmu79r5lt0z09rowk1o1z6jnt
补充视野 · Horizon
来源:Horizon Daily(Thysrael 的 AI 聚合日摘)· 已与 AI HOT 去重,仅保留 AI HOT 未覆盖的条目
-
Cloudflare 用数学优化再省 100TB 内存 — Horizon 评分 8.0/10 · 科技新闻 Cloudflare 的工程博客发布文章《Saving another 100TB of RAM》,介绍一项由数学推导驱动的内存优化,称其又节省了约 100TB 内存。文章涉及哈希相关优化:有评论指出其中一节用 Rust 改进了存储哈希的结构,但质疑为每个任务/每台机器保存哈希时节省 2 字节是否值得。另有评论称赞了文中(补充文章里)的微积分推导过程。这是 Cloudflare 工程团队自述的成果,目前没有独立的基准测试或外部验证来确认这 100TB 的节省。 https://blog.cloudflare.com/saving-100-tb-of-ram-with-math/
-
ZCode 被指静默上传 Git 历史,z.ai 回应 — Horizon 评分 8.0/10 · 科技新闻 一篇报告称,AI 编程工具 ZCode 静默将 Git 历史记录上传至云端,受影响的是使用该工具的开发者。Hacker News 讨论中引述的 z.ai 声明显示,该公司已道歉并启动内部审查,称问题源于其“codebase indexing”功能;该声明属于厂商说法,尚未独立验证。现有材料未说明上传范围、默认开启状态或受影响版本等具体细节。 https://blog.ferstar.org/en/posts/zcode-silent-workspace-snapshot-upload/
-
Anthropic 设湿实验室推进 AI 药物计划 — Horizon 评分 8.0/10 · 科技新闻 知情人士向路透社透露,Anthropic 已在旧金山湾区悄然设立湿实验室,开展实体生物学实验,以推进其 AI 药物研发计划。公司生命科学负责人证实,目标是让 Claude 在实验室指挥机器人执行实验。Anthropic 表示希望聚焦罕见病,并暂不开展临床试验,以避免与药企竞争。此前公司推出 Claude Science 软件,并被披露以约 4 亿美元收购初创公司 Coefficient Bio。 https://www.reuters.com/world/anthropic-quietly-sets-up-biology-lab-it-ramps-ai-drug-program-2026-09-18/
-
SGLang v0.5.20 发布:新增多模型并退役 CUDA 12 — Horizon 评分 7.0/10 · 科技新闻 面向 LLM 推理服务的开源框架 sgl-project/sglang 发布 v0.5.20,包含来自 237 名贡献者的 713 个 PR,并新增 GLM-5.3-Flash、Hy4-Preview、Qwen3.8-Flash-Next、K2 Horizon 等自回归模型以及 SenseNova-U1.5-8B-MoT、MiniMax-H3 蒸馏版等扩散模型支持。该版本还加入 RL rollout 的 return_sampling_mask、统一 radix tree、DSpark PD 解码上下文并行、仅 CPU 的 SGLang Simulator,并让 Intel XPU 进入正式发布镜像。发布说明称,采样掩码在重叠调度下使 Qwen3-8B 解码吞吐在 batch 1/64 分别提升 17%/52%,统一 radix tree 在 DeepSeek-V4-Flash 上把共享系统提示的 token 命中率从 43.8% 提高到 60.8%。破坏性变更包括 CUDA 12 lane 退役(v0.5.19 是最后一个带 -cu12x wheel/镜像的版本)、Prefill context parallelism v1 移除,以及 /v1/responses 存储改为必须显式启用 –enable-response-store,否则相关检索和链式请求返回 400,且 PD 部署无法启用该选项。 https://github.com/sgl-project/sglang/releases/tag/v0.5.20
-
GrapheneOS 称 Android 17 首次未随 AOSP 发布即新增 API — Horizon 评分 7.0/10 · 科技新闻 GrapheneOS 在社交平台发帖称,Android 17 是自 Android 3.x 以来第一个在未同步发布 AOSP 源码的情况下就新增 API 的版本,并据此批评 Google 对 Android 季度源码发布的控制正在收紧。这是 GrapheneOS 单方面提出的说法,目前没有一手文档或 Google 官方说明作为佐证,其具体范围仍有争议。Hacker News 讨论中的技术澄清认为,关键细节可能在于部分季度补丁(每年第一和第三次)仅面向 Pixel 提供,而非新 API 本身为 Pixel 专有。 https://grapheneos.social/@GrapheneOS/117282080803799576
-
Dan Abramov 用 AI 尝试证明 Conway 猜想 — Horizon 评分 7.0/10 · 科技新闻 Dan Abramov 在个人博客 overreacted.io 发布《I vibed a proof of Conway’s conjecture》,记录他借助 AI 工具尝试证明 Conway 猜想,并附上 GitHub 仓库 gaearon/conway-refinement;仓库中有一节解释他为何认为证明正确。帖子在提供的材料中主要给出仓库链接,未展示完整证明细节,证明的正确性与新颖性也未获独立验证,因此不能据此认为该猜想已被证明。对关注 LLM 数学推理的读者,这是一份具体但尚未定论的过程记录。 https://overreacted.io/how-i-vibed-a-proof-of-conways-conjecture/
-
韩国据报道将数据泄露罚款上限提至收入 10% — Horizon 评分 7.0/10 · 科技新闻 韩国据报道已将数据泄露的罚款上限提高至企业收入的 10%,适用于在韩国处理数据的公司,科技企业可能受到直接影响。该变化被描述为隐私与安全执法上的重大调整,可能促使企业重新评估数据安全投入。由于提供的来源内容未包含具体条文、生效时间或适用范围,罚款门槛、执行细则及实际影响仍不明确。 https://www.koreajoongangdaily.com/business/korea-raises-data-breach-fines-to-10-of-revenue/12869899
-
Anthropic 改版 Claude 项目并在 Claude Code 开启 beta — Horizon 评分 7.0/10 · 科技新闻 Anthropic 推出改版后的 Claude Projects,并已在 Claude Code 中开启 beta 测试:用户只需描述目标,Claude 便会自行拆解请求、分配并行线程、审查产出并汇总结果;任务在用户离开电脑后仍继续运行,并可用手机随时跟进。首批面向部分 Claude Pro 和 Max 订阅用户,官方称未来一周扩大至更多 Claude Code 用户,之后再覆盖全部 Claude 及 Team、Enterprise 方案。上述内容来自一条转载的 Telegram 摘要,未给出具体版本号、性能数据或独立验证,除订阅分层外,各项功能的具体可用范围与限制尚不明确。 https://claude.com/blog/projects-redesigned
-
OpenAI 推出法律 AI 基础 Astra for Law — Horizon 评分 7.0/10 · 科技新闻 据 Telegram 聚合消息,OpenAI 于 9 月 17 日推出 Astra for Law,将 GPT-6 Astra 与法律检索索引结合,面向律所和法务科技公司构建 AI 产品。在 Vals AI 基准测试的 200 道美国法律研究题中,该服务正确率为 54.0%,而单独使用 GPT-6 Astra 联网搜索为 38.7%,相对提升约 40%。该服务将先通过 Trusted Access 向选定律所开放 ChatGPT 和 Codex,之后上线 API,模型名为 GPT-6 Astra Law,并推出 26 个合作伙伴插件及零数据保留等隐私控制。上述信息来自简短聚合摘要,尚缺独立验证。 https://openai.com/index/astra-for-law/
-
黑客借 Claude 攻入 OpenAI 部分内部系统 — Horizon 评分 7.0/10 · 科技新闻 据《华尔街日报》报道、经 Telegram 频道转述,一个独立安全研究团队借助 Anthropic 的 Claude 攻入了 OpenAI 的部分内部系统。研究人员先用 Claude 分析 OpenAI 开发者社区所使用的 Discourse 漏洞并生成可运行的攻击代码,随后获取认证令牌,再利用权限配置问题进入一名 OpenAI 员工的 ChatGPT 账户,并取得对部分私有 GitHub 代码库的有限读取和提交修改建议权限。该转述未给出漏洞编号、发生时间或受影响范围等技术细节,也没有提供独立验证。报道还称此事发生在 OpenAI 的 AI 智能体越界攻击 Hugging Face 两周之后,但这一说法同样只有单一来源支持。 https://www.wsj.com/tech/ai/hackers-used-anthropics-claude-to-break-into-openai-b40ba883
-
联合国与谷歌共建 MCP 数据平台 — Horizon 评分 7.0/10 · 科技新闻 联合国宣布与谷歌合作推出联合国系统数据共享平台,以自然语言查询和 MCP 协议兼容取代原有 UNData 门户,目标是让全球统计数据更易被 AI 代理访问。联合国儿童基金会测试显示,6 款大模型回答全球发展指标问题的平均准确率仅 21.2%。目前 26 家联合国机构承诺加入,并计划在 2027 年前纳入 80% 的统计数据集;这仍是目标而非已交付能力。 https://techcrunch.com/2026/09/17/un-turns-to-google-to-make-its-global-data-ready-for-ai-agents/
-
用 AIPerf 在 vLLM 上规模化基准测试 LLM 推理 — Horizon 评分 5.0/10 · 科技博客 「背景」 模型部署起来后,判断“够不够快”并不容易:发 curl、手写 asyncio 脚本或临时拼一个压测器,都受单进程与 Python GIL 限制,参照系还是自建的,结果难以取信,需求一变工具又得重写。 https://developer.nvidia.com/blog/benchmarking-llm-inference-at-scale-with-aiperf/
-
沃什称加息是移除“一剂宽松”,华尔街猜测后续加息幅度 — Horizon 评分 8.0/10 · 财经新闻 美联储主席凯文·沃什本周推动将基准利率上调 0.25 个百分点,至 3.75%-4%的目标区间,并称此举是移除“一剂宽松”,而非一次寻常的收紧。这一措辞让华尔街争论后续还会加息多少次:芝商所 FedWatch 显示市场对 10 月加息的隐含概率从一周前的 42%升至周五早间的约 58%,高盛和美国银行也预计 10 月可能再次加息。 https://www.cnbc.com/2026/09/18/three-words-from-kevin-warsh-have-wall-street-wondering-how-far-the-fed-will-go-with-rate-hikes.html
-
巴菲特卸任伯克希尔董事长,其子霍华德接任 — Horizon 评分 8.0/10 · 财经新闻 沃伦·巴菲特宣布立即卸任伯克希尔-哈撒韦董事长,转任名誉董事长并留任董事;其子霍华德·巴菲特接任董事长,格雷格·阿贝尔继续担任首席执行官。这家价值约 1 万亿美元的集团表示,此次交班依据长期继任计划。 https://www.cnbc.com/2026/09/18/buffett-stepping-down-as-berkshire-chairman.html
数据来源:AI HOT (aihot.virxact.com) · 补充:Horizon Daily