AI HOT 日报 · 2026-09-16
2026-09-16 AI HOT 日报:共 13 条 AI 圈要闻,覆盖模型发布/更新、产品发布/更新、行业动态、技巧与观点,聚焦大模型发布、AI 产品更新与行业动态,每日更新。 📚 查看全部日报
模型发布/更新
-
Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking — Google DeepMind:Blog(RSS) Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个近实时语音对话模型,主打语音智能体和复杂任务执行。 https://aihot.news/items/cmu2xqfxz02zhroc1hxuzi6jm
-
生数科技发布 Vidu S2:含 Avatar 与 Editing 双模型,探索空间视频 — 公众号:生数科技(Vidu·视频) 生数科技正式发布 Vidu S2,包含面向数字角色实时交互的 Vidu S2-Avatar 和面向视频流实时编辑的 Vidu S2-Editing,并探索面向 VR 头显的实时空间视频生成与编辑。 https://aihot.news/items/cmu2t7e9005xhro3xi5oq27e7
-
阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一 — 公众号:阶跃星辰(Step) 阶跃星辰发布 StepAudio 3 系列,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已在阶跃星辰开放平台上线。 https://aihot.news/items/cmu2d4jj405xcro25xm50v262
产品发布/更新
-
Google 发布 TranslateGemma 等多语言 AI 成果,语言技术覆盖 300 多种语言 — Google Blog:AI(RSS) Google 宣布其语言技术已支持超过 300 种语言、覆盖全球 86% 人口,并发布 TranslateGemma 轻量开源翻译模型(基于 Gemini 训练、支持 55 种语言、可离线运行)。 https://aihot.news/items/cmu2vlgqe03sxrowkkyx8bc1s
-
Claude for Small Business 新增 43 个工作流和 27 个集成,并推出免费培训计划 — Claude:Blog(网页) Anthropic 为 Claude for Small Business 新增 43 个工作流和 27 个集成,覆盖 Shopify、Salesforce、Stripe、Gusto 等,该产品自 5 月上线以来安装量超过 90 万次。工作流默认处于审批模式,所有发送、发布或付款需用户确认;今秋将在 10 个美国城市举办免费工作坊,14 个集成伙伴从 9 月底到 11 月各举办一场免费网络研讨会。 https://aihot.news/items/cmu2xv8tm0365roc1a401zg9y
行业动态
- Perplexity 自研 CobbleDB 替代 AWS DynamoDB,每年最多可节省一亿美元 — X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas) Perplexity CEO Aravind Srinivas 宣布自研键值数据库 CobbleDB,替代 AWS DynamoDB 用于快速网页内容抓取,迁移后每年最多可节省一亿美元。该项目由两名工程师和数百个持续运行的 Computer 智能体在两个月内完成核心基础设施,官方研究称热存储批次读取延迟较 DynamoDB 全分布下降约 5 倍(P50 从 31.4ms 降至 5.60ms)。 https://aihot.news/items/cmu352k2908t9rosaotpsx42c
技巧与观点
-
Gergely Orosz 探访 OpenAI:Codex 驱动的智能体软件工厂 — Pragmatic Engineer(RSS) Gergely Orosz 实地探访 OpenAI 总部并访谈七位工程师与工程负责人,发现自约一月起 Codex 和 ChatGPT Work 已成为公司几乎所有工作的基础。 https://aihot.news/items/cmu2utske02sjrowk2zs2agim
-
Anthropic 与 OpenAI 提议协调放缓前沿 AI 开发,Cohere CEO 等批评者质疑其真实动机 — The Decoder:AI News(RSS) Anthropic CEO Dario Amodei 呼吁行业与政府协调放缓前沿 AI 开发,并寻求反垄断豁免,Sam Altman 与 Elon Musk 表示同意。 https://aihot.news/items/cmu2gnngu032brovqo7pvrfx9
-
404 Media 曝光 OpenAI 莉莉计划:人工审核 ChatGPT 聊天记录以优化模型 — IT之家(RSS) 404 Media 披露 OpenAI 内部代号为莉莉计划(Project Lily)的项目,由时薪超 50 美元的提示词审核员查看匿名化后的真实用户聊天记录,评判回复是否切题、是否存在 AI 式话术和谄媚口吻。 https://aihot.news/items/cmu2n8sq10chlrovqbe47wj5t
-
Arena 更新 Image-to-WebDev 榜单:GPT-6 Astra 以 1733 分登顶 — X:Arena (@arena) Arena 更新 Image-to-WebDev 排行榜,纳入四个新评测模型。GPT-6 Astra (Max) 以 1733 分居第一,领先 GPT-5.6 Sol (xHigh) 129 分;Claude Fable 5.1 (Max) 以 1710 分排第二,Muse Spark 1.3 (Max) 1645 分第四,GLM-5.3-Flash 1588 分第十。 https://aihot.news/items/cmu36fa060aaqrosaqk9opwh9
-
Artificial Analysis 评测:GPT-Live-1 以 81.5 分登顶 Speech to Speech Index — X:Artificial Analysis (@ArtificialAnlys) Artificial Analysis 发布 Speech to Speech Index,OpenAI 的 GPT-Live-1 以 81.5 分(Astra 后端,medium 推理强度)排名第一,超过 Grok Voice Think Fast 2.0 High 的 81.3;Sol 后端配置得 80.1 排第三。 https://aihot.news/items/cmu23uewb08bfrow2t7lv6cxc
-
Trail of Bits 批评 1Password 的 AI 补丁基准存在误导,并发布两个补丁验证 Agent 技能 — Trail of Bits:AI安全研究 Trail of Bits 发文批评 1Password 8月6日发布的 FLAWED 报告,称其 26% 的 AI 干净修复率受四项实验设计选择影响而失真,包括刻意指示智能体应用错误修复的提示词占 22% 数据、36% 的试验禁止编译测试,以及不同推理档位设置。 https://aihot.news/items/cmu2lqodj08k0rovqocv9r3z3
-
Vercel 将 inbound 销售团队从 10 人压缩至 1.25 人,AI 销售开发智能体年成本仅数千美元 — Tomer Tunguz 博客(VC 分析) Vercel COO Jeanne DeWitt Grosser 在 The Information 访谈中表示,公司 inbound 销售开发已实现 90% 自动化,团队从 10 人压缩至 1.25 人。 https://aihot.news/items/cmu3a2rht0goyrosayo2gs0nh
补充视野 · Horizon
来源:Horizon Daily(Thysrael 的 AI 聚合日摘)· 已与 AI HOT 去重,仅保留 AI HOT 未覆盖的条目
-
Typesafe.ai 发布 System One Models 与 Jev — Horizon 评分 7.0/10 · 科技新闻 Typesafe.ai 发布了 System One Models 和 Jev,将其定位为面向结构化输出的类型化推理替代方案,而非通用 LLM 生成。该发布在 Hacker News 引发讨论,评论者认可其新颖性,但质疑其速度对比是否公平:通用生成模型能输出图灵完备语言代码,理论上可完成计算机能做的任何事,而 Jev 据称只能生成结构化输出。社区从文档中理解到,模型可能接收一个状态(是否为结构化文本、是否多模态尚不明确)和一个问题(Choice、Score 或 Noul 等类型),并输出选择、概率和置信度等结果,此外还可附加增强。评论还将其与设计契约、编码器模型等已有方法比较,并提到 AI primer 页面涉及 RLCD 过程,但具体内容不完整。整体上,发布帖和评论是当前唯一证据,尚无独立验证或行业影响证明。 https://typesafe.ai/blog/introducing-system-one-models-and-jev
-
Wayback Machine 访问保护与抓取压力更新 — Horizon 评分 7.0/10 · 科技新闻 互联网档案馆(Internet Archive)就 Wayback Machine 的访问状况发布更新,称其遭遇多轮高流量自动化请求,并已部署保护措施以维持服务运行。讨论中引述的说法认为,这些抓取者试图通过访问 Wayback Machine 的存档副本,绕过对原始站点的访问封锁,给这家非营利基础设施带来额外负载,并已促使部分网站选择退出。相关影响包括用户不时遇到 429 错误、服务可用性不稳定,但仍有用户报告可通过 Tor 匿名访问、不经过 Cloudflare 等中心化网关。社区普遍赞扬档案馆维持开放访问,同时担心 AI 训练与数据抓取竞赛带来的附带损害,并讨论监管、罚款等可能应对方式。 https://blog.archive.org/2026/09/15/an-update-on-wayback-machine-access/
-
Strix 称 AI 代理 25 分钟取得 Baseten 生产 GitHub 权限 — Horizon 评分 7.0/10 · 科技新闻 安全厂商 Strix.ai 在一篇博客中声称,其 AI 渗透测试代理在约 25 分钟内发现了一个泄露的 Baseten GitHub 个人访问令牌(PAT),该令牌属于 basetenbot,并可访问 Baseten 的生产相关仓库。据其描述,该令牌拥有对 Baseten 主产品仓库、驱动其集群的 GitOps 仓库和 Homebrew tap 的管理员/推送权限,还对其他私有仓库(包括按客户划分的特定仓库)有读写权限。令牌据称是在找到 Baseten 的镜像仓库后,从 Docker 构建历史中发现的。社区评论中引述的披露时间线显示,7 月 13 日 23:10 报告了活跃的 basetenbot 令牌、公开的 Harbor 项目和仓库权限;7 月 14 日上午 Harbor 项目被设为私有但令牌仍有效;7 月 14 日 16:34 Baseten 安全团队的 Anton 确认其为严重问题,将 Harbor 项目设为私有并轮换了令牌,同时要求安全删除已拉取的镜像。这一披露来自安全厂商博客,带有推广性质,且评论对其合法性、伦理和营销方式提出质疑,因此具体影响仍需谨慎看待。 https://www.strix.ai/blog/baseten-harbor-github-pat-takeover
-
Capsule:把 HTML 应用和数据打包为单个 SQLite 文件 — Horizon 评分 7.0/10 · 科技新闻 开发者 bashtian 在 Hacker News 发布 Capsule:一个用 Rust 和 Tauri 2.0 构建的工具,可把 HTML 应用及其数据打包进单个 SQLite 文件(扩展名也为 Capsule)。HTML 与相关资源直接嵌入数据库;用户数据可用 localStorage 键值存储,或通过受 MongoDB 启发的 collections API 以文档形式保存在表中,PDF、图片等资产也可一并存入,并支持导出 CSV 或 JSON。Capsule 强调隐私与安全:文档默认没有文件系统访问权限,联网需要获得许可,权限模型仍在改进;文档还可使用本地或远程 AI 模型实现特定 AI 功能。由于多人分别编辑会产生不同副本,Capsule 为每条数据项加入唯一 UUID 和时间戳以便合并,并计划在 1.0 版本开放文件格式规范;作者表示新版本会提供迁移,避免数据丢失。该发布在 HN 获得 267 分和 114 条评论,讨论集中在与 File System Access API 的对比,以及同步、应用更新、数据与应用分离和分发开销等问题。 https://withcapsule.app/
-
把 20 美元 4G 热点改造成可收发短信的设备 — Horizon 评分 7.0/10 · 科技新闻 一位开发者将售价约 20 美元的 4G 无线热点改造成可以收发短信的设备,并把改造过程发布在项目页面上。该作品属于嵌入式硬件 DIY 方向,涉及 4G LTE 模块与嵌入式 Linux,目标是让廉价热点承担类似「傻瓜手机」的短信与验证码查看功能。社区评论中,有人表示自己刚买了约 10 美元的 4G 上网棒,打算拆开查看内部结构,并指出部分基于 MSM8916 的上网棒虽然没有显示屏却仍运行 Android 界面。还有评论建议加装可容纳两节并联 18650 电池的电池仓以显著延长续航,并认为复用 Clicks 键盘是巧妙的设计,成品可视为一台体积不大的「赛博甲板」(cyberdeck)。讨论普遍把实用场景落在用低成本硬件替代手机处理短信与 OTP 验证码。 https://bkovac.github.io/modem-thing/
-
Schneier 发文:25 年大规模监控已经够了 — Horizon 评分 7.0/10 · 科技新闻 Bruce Schneier 发表文章《25 年的大规模监控已经够了》,主张持续四分之一世纪的大规模监控应当终结。该文属于政策评论与倡议,而非技术突破或工程分析,围绕隐私、国家权力与技术替代方案展开。文章在 Hacker News 上引发大量讨论,评论者从不同角度回应监控扩张及其后果。由于原文内容未提供,具体论证细节和所涉政策条款无法在此确认。 https://www.schneier.com/blog/archives/2026/09/25-years-of-mass-surveillance-is-enough.html
-
Simon Willison 发布 Gemini 3.8 Live 浏览器语音测试界面 — Horizon 评分 7.0/10 · 科技新闻 Google 发布了 Gemini 3.8 Live 和 3.8 Live Extended Thinking 两款语音到语音(speech-to-speech)模型,形态与 OpenAI 的 GPT-Live 模型类似。Simon Willison 同日发布了一个基于浏览器的 Gemini Live audio 工具,用于试用这两款新模型。该界面支持选择模型和语音预设、输入可选的系统提示词,并通过浏览器发起语音对话,还能在模型说话时打断它。实现不依赖任何库,连接 wss://generativelanguage.googleapis.com/ws/google.ai.generativelanguage.v1alpha.GenerativeService.BidiGenerateContent?key=… WebSocket 端点,并使用 Web Audio API 的 AudioContext 完成采集与播放。页面提供转录文本的下载和清除,并提示发送文字消息会打断当前回复,转录可能包含播放前被中断的语音。 https://simonwillison.net/2026/Sep/15/gemini-live/
-
Linux 内核补丁提议为 blk-iocost 引入 BPF 成本模型 — Horizon 评分 7.0/10 · 科技新闻 Tao Cui 提交的补丁系列(第三版 RFC)提议为 Linux 内核的 blk-iocost 块 I/O 控制器加入 BPF 支持,使 I/O 成本计算可由加载的自定义程序决定。该系列引入一种新的 struct_ops 程序类型 iocost_model_ops,其中核心且唯一必需的操作是 calc_cost(),其参数包括请求标志 opf、请求字节数 nbytes、扇区位置 sector、发起请求的块控制组 blkcg,以及可能含 IOCOST_COST_F_MERGE 标志的 model_flags,返回值即为该请求被计入的成本;可选的 blkcg_online() 与 blkcg_offline() 在该控制器被加入或移出控制组时调用,供 BPF 程序做簿记。加载程序本身不会把新成本函数绑定到设备,需要向控制组目录中的 io.cost.model 文件写入结构中 16 字节的 name 来选用模型。该改动只覆盖成本计算部分,每几毫秒运行一次、负责重新分配带宽并调整设备 vtime 推进速率的规划阶段保持不变。补丁集附带一个示例程序,用 BPF map 跟踪最多四个独立 I/O 流,若请求在任一被跟踪流中看似顺序访问就按顺序请求计费,以改善含多个顺序 I/O 进程的控制组的表现。 https://lwn.net/Articles/1093661/
-
LLM 的“记忆”其实由应用层重建 — Horizon 评分 6.0/10 · 科技博客 「背景」 在同一段对话中,LLM 能引用几条消息前说过的内容,但新开一个聊天就“忘光”了,仿佛只有金鱼般的记忆。文章要解释的是:既然模型本身不存储对话,这种“记得”究竟从何而来。 https://blog.bytebytego.com/p/do-llms-have-the-memory-of-a-goldfish
-
Groq 3 LPX 确定性执行与能效优化 — Horizon 评分 4.0/10 · 科技博客 「背景」 AI 工厂受功耗硬约束,性能功耗比而非原始吞吐成为衡量平台的关键。Vera Rubin 用工厂级 DSX MaxLPS 和机架级智能功率平滑管理电力,但高交互层级仍需 Groq 3 LPX 提供低延迟推理。 https://developer.nvidia.com/blog/how-nvidia-groq-3-lpx-deterministic-execution-drives-power-efficient-high-interactivity-inference-on-nvidia-vera-rubin/
-
中国 8 月零售增速低于预期,投资降幅加深 — Horizon 评分 8.0/10 · 财经新闻 中国国家统计局数据显示,8 月社会消费品零售总额同比增长 0.4%,低于路透调查经济学家预期的 0.8%,也较 7 月的 0.6%放缓;1 至 8 月城镇固定资产投资(含房地产与基础设施投资)同比下降 7.2%,降幅比 1 至 7 月的 6.7%进一步扩大。 https://www.cnbc.com/2026/09/15/china-august-retail-sales-industrial-output-investment-exports-.html
数据来源:AI HOT (aihot.virxact.com) · 补充:Horizon Daily