AI HOT 日报 · 2026-08-18
2026-08-18 AI HOT 日报:共 18 条 AI 圈要闻,覆盖产品发布/更新、行业动态、论文研究、技巧与观点,聚焦大模型发布、AI 产品更新与行业动态,每日更新。 📚 查看全部日报
产品发布/更新
-
Cursor 推出 Origin 代码托管服务,作为 GitHub 的替代方案 — Hacker News 热门(buzzing.cc 中文翻译) Cursor 今日起向所有付费计划用户开放 Origin 代码托管的早期测试版,提供仓库、拉取请求、代码浏览及 GitHub 同步功能。用户可创建以 cursor.com/codebase/ 为前缀的仓库,或将 GitHub 仓库同步至 Origin,双向同步评论与审查。Vercel、Depot 和 Buildkite 集成已可用,智能体功能即将推出。 https://aihot.virxact.com/items/cmsxsvb5s0a4troz0z2q2nu3h
-
OpenRouter 推出 Activity 仪表盘与 Analytics API:按智能体、模型、请求追踪 AI 使用成本 — OpenRouter:Announcements(RSS) OpenRouter 发布 Activity 仪表盘和 beta Analytics API,可按智能体、模型、请求维度查看支出、token 量、缓存命中率等指标,并支持下钻至单条请求日志。 https://aihot.virxact.com/items/cmsx7ffrz049uromm6en3if02
-
OpenRouter 图像生成 API:代码优先的接入教程 — OpenRouter:Announcements(RSS) OpenRouter 推出专用图像生成 API,通过统一请求格式和单一密钥即可调用多个提供商的图像模型。开发者向 POST /api/v1/images 发送请求,响应中的 data[0].b64_json 包含 base64 编码的图像数据,解码后即可保存为本地文件。教程演示了 Python 和 JavaScript 两种实现,并支持通过 input_references 传入参考图像生成变体。 https://aihot.virxact.com/items/cmsxqq46m07msroz0jt2la4p6
-
AgentCore Payments 中间件为 LangChain 智能体提供 API 支付能力 — LangChain:Blog(RSS) AgentCore Payments 中间件让 LangChain 智能体以确定性会话预算支付 API 费用。该中间件为 x402 支付签名,LangSmith 可追踪每一笔支付记录。 https://aihot.virxact.com/items/cmsxebmb6021wroi2l5h9u16e
-
Claude Code v2.1.234 发布:新增项目目录名变量与 GitLab MR 徽章,修复多项安全与稳定性问题 — Claude Code:GitHub Releases(RSS) Claude Code v2.1.234 新增可选 CLAUDE_CODE_PROJECT_DIR_NAME 环境变量、selection:clear 键绑定及 GitLab MR 徽章,并在用量限制重置后自动继续会话。 https://aihot.virxact.com/items/cmsxpts5p06yoroz00hfoz9ch
行业动态
-
NVIDIA 与 SB Energy 合作锁定俄亥俄州 PORTS-Pike 园区电力容量,OpenAI 将入驻 — NVIDIA Blog(RSS) NVIDIA 宣布与 SB Energy 合作,锁定俄亥俄州 PORTS-Pike 科技园区的电力容量(LPS)以独家部署 NVIDIA 算力,OpenAI 将成为租户。 https://aihot.virxact.com/items/cmsx9jvre05y6romms3bo1umb
-
A 股迎来“人形机器人第一股”,宇树科技官宣 8 月 19 日科创板上市 — IT之家(RSS) 宇树科技宣布股票将于 2026 年 8 月 19 日在科创板上市,发行价 150.80 元/股,对应市值约 609.93 亿元,预计募资约 60.99 亿元。该公司 2023 至 2025 年营收分别为 1.59 亿元、3.93 亿元和 16.99 亿元,净利润分别为-1114.51 万元、9547.47 万元和 2.78 亿元,是全球少数实现盈利的高性能通用机器人公司。 https://aihot.virxact.com/items/cmsx9jy2a05yerommy1e0jc6t
-
404 Media 追踪珍本图书流向:亚马逊批量购书扫描用于 AI 训练后销毁 — Hacker News 热门(buzzing.cc 中文翻译) 404 Media 通过在一本珍本图书中放置追踪设备,首次揭露亚马逊未公开的购书行动:批量购入大量书籍,扫描用于 AI 训练数据,随后销毁。追踪显示这些书最终被送往亚马逊的一处人工智能训练中心。 https://aihot.virxact.com/items/cmsxld6es03o8roz0jblf3ii9
-
OpenAI 为 14 个独立项目提供资助,推动智能时代经济机遇与韧性研究 — OpenAI:官网动态(RSS · 排除企业/客户案例) OpenAI 宣布向 14 个由独立组织主导的项目提供总计 100 万美元资金及最高 100 万美元 API 额度,以推动 AI 进步下的经济机遇与社会韧性研究。 https://aihot.virxact.com/items/cmsx4vvm301g9romm3o5n8btx
论文研究
- PhotoScan:用智能手机照片估算胰岛素抵抗,精度接近DXA — Google Research:Blog(网页) Google Research 推出 PhotoScan,一种从智能手机 2D 照片直接估算三维身体成分的深度学习框架,可预测胰岛素抵抗,在临床研究中精度接近 DXA 扫描。 https://aihot.virxact.com/items/cmsxq3q3x07h2roz0z906es50
技巧与观点
-
OpenAI 如何用前沿智能加固自身防御:The Defender’s Window — OpenAI:官网动态(RSS · 排除企业/客户案例) OpenAI 在 OpenAI-Hugging Face 事件后反思低估了模型真实网络攻击能力,正通过四大支柱强化自身安全:用 Codex 验证代码漏洞、用智能体优先分流安全告警、持续枚举攻击路径,并仅向可信防御者开放网络能力。文中演示 ChatGPT Work(基于 GPT-5.6 Sol)15 分钟发现个人网站 13 个问题并在一小时内完成修复。 https://aihot.virxact.com/items/cmsx9696t05u7rommdoa60l4p
-
如何禁用或避免侵入式 AI:一份覆盖 Windows、Chrome、Edge、Firefox 及主流应用的实用指南 — Hacker News 热门(buzzing.cc 中文翻译) 一份面向希望减少技术环境中侵入式 AI 的用户的操作指南,涵盖 Adobe Acrobat、Android/Gemini、Apple Intelligence、Chrome、Edge、Firefox、DuckDuckGo、Google Workspace、Slack、WhatsApp 及 Windows 11/Copilot 等平台。 https://aihot.virxact.com/items/cmsxkakju0300roz0zx6cvdeu
-
用 Google 的 Agent Development Kit 构建零信任 AI 智能体 — Google Developers Blog(RSS) Google 开源了基于 ADK 和 Gemini 的零信任客服与退货智能体示例,演示如何防御提示注入等攻击。该架构在 LLM 上下文之外通过三层硬性安全机制保障:硬件支持的加密签名确保数据库写入不可抵赖、gVisor 沙箱隔离动态代码执行、确定性语义网关校验业务逻辑。系统提示词只是软约束,无法作为安全边界。 https://aihot.virxact.com/items/cmsxv0p3v0bntroz0227a6b3j
-
开源模型生态的未来:Nvidia 押注“教所有人炼 token” — Nathan Lambert:Interconnects(RSS) 开源模型生态正日益依赖 Nvidia 的资助,其已投入 260 亿美元推动近乎开源的模型开发,以扩大推理芯片需求。若此路径不奏效,开源模型将转向效率、可修改性等长尾场景,与闭源模型分化。同时,基础模型训练门槛升高,开源社区兴趣正从全量训练转向对 DeepSeek V4 Flash、GLM 5.X 等模型的微调。 https://aihot.virxact.com/items/cmsxfcx2n036jroi2rxg0tdmq
-
同一集群利用率提升 33 个百分点:改变的是分配顺序 — Hugging Face:Blog(RSS) Hugging Face 构建了一个约束感知的 GPU 分配器,并在七个基准场景中与 FIFO 调度器对比。在相同硬件和负载下,GPU 利用率最高提升 33 个百分点,优先级加权输出在全部场景中均上升,最高达 105%。分配器将实时推理需求按曲线而非峰值处理,批量任务按优先级跨整个调度周期排序,从而回收了预留闲置容量。 https://aihot.virxact.com/items/cmsxnxhxa05wjroz0grlpa8a9
-
ABC Legal 如何借助 Claude Managed Agents 让每位员工成为构建者 — Claude:Blog(网页) ABC Legal 为 1,100 名员工部署 Claude Enterprise 后,通过 Claude Managed Agents 将零散实验转变为受治理的智能体体系,截至 2026 年 7 月已上线 50 多个生产级智能体,部分覆盖的人工任务成本降低约 50%,约 310 名员工日常使用 Claude。 https://aihot.virxact.com/items/cmsxi809j02vnroswjnpyp2gv
-
当模型持续学习:测试时训练如何改变 AI 的记忆与成本 — Tomer Tunguz 博客(VC 分析) 测试时训练(Test-time training)让模型在使用中持续更新权重,而非训练结束后冻结。相比标准 Transformer,其内存需求从随上下文线性增长变为恒定,斯坦福研究显示推理速度最高可提升 2.7 倍,且 In-Place TTT 无需重训即可将 4B 模型提升至 128k 上下文性能。但代价是每个用户需独立模型副本,服务成本转向算力与芯片,更适合编码助手等个性化场景。 https://aihot.virxact.com/items/cmsxj97e9016aroz080y9zfto
-
SGLang 重构 CUDA Graph 支持,Breakable CUDA Graph 成 prefill 默认方案 — LMSYS:Blog(Chatbot Arena 团队) SGLang 重构 CUDA Graph 支持,通过 runner/backend 接口拆分使不同捕获策略可复用。其社区首创的 Breakable CUDA Graph(BCG)现为 prefill 默认方案,代码量仅为 torch.compile 方案的约四分之一(521 行对比 1,771 行),构建速度快 3.8–5.2 倍。 https://aihot.virxact.com/items/cmsxjbtk6018lroz0ywmuve4h
补充视野 · Horizon
来源:Horizon Daily(Thysrael 的 AI 聚合日摘)· 已与 AI HOT 去重,仅保留 AI HOT 未覆盖的条目
-
DuckDB v2.0 预览:全新 VARIANT 类型与更强外向核处理 — Horizon 评分 9.0/10 · 科技新闻 DuckDB v2.0 预览展示了多项主要增强,包括用于半结构化数据的快速 VARIANT 类型,以及更强的 out-of-core 处理能力。VARIANT 被视为“增强版 JSON”,能自动检测并切分半结构化数据中的公共结构,从而在存储中获得更好的压缩效果。这让处理异构 JSON/Parquet 的用户有望降低存储开销并提升查询性能。同时,v2.0 对超出内存的数据处理进行了增强,使低端消费级硬件也能承载更大规模分析。社区反应热烈,但也有用户对半年内约 10,000 次提交的加速开发节奏提出疑问。 https://duckdb.org/2026/08/17/duckdb-20-highlights
-
Qwen 3.8 27B 在 Artificial Analysis 智能指数中获 52 分 — Horizon 评分 9.0/10 · 科技新闻 Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 上取得 52 分,与 GPT-5.6 Luna (max) 持平,仅比 GLM-5.2 (max) 和 DeepSeek V4 Pro 0813 (max) 低 1 分。其中 GLM-5.2 为 753B 参数,DeepSeek V4 Pro 0813 为 1.6B 参数(以来源内容为准),Luna 参数规模未知但被认为远大于 27B。这一结果凸显了 27B 级模型在效率上的突破,Simon Willison 称之为“真正令人惊叹的模型”。对实际部署而言,意味着一系列原本需要大型模型的任务可以由更小的模型完成。 https://simonwillison.net/2026/Aug/17/qwen-38-27b-scores-52/
-
追踪稀有书籍包裹发现亚马逊 AI 训练设施 — Horizon 评分 8.0/10 · 科技新闻 404 Media 进行了一项调查,通过 AirTag 追踪一批约 1000 本稀有书籍的订单,最终发现包裹被送至位于拉斯维加斯东北部的亚马逊 LAS8 设施 VGT3 区域,该入口还带有恐龙啃书的标志。亚马逊员工的线上讨论证实,VGT3 会以破坏性方式扫描大量书籍。此次调查为长期以来的怀疑提供了直接证据,即那些匿名、对价格不敏感的大额购书订单实际上是 AI 公司为获取训练数据而下单。此前已有报道称 Anthropic 在 2025 年 6 月也进行过类似的书本扫描。这件事暴露了 AI 训练数据获取过程的透明度问题。 https://simonwillison.net/2026/Aug/17/we-tracked-a-shipment-of-rare-books-it-ended-at-an-amazon-ai-tra/
-
Rust GPU 卸载模块:可移植、安全且快速 — Horizon 评分 7.0/10 · 科技新闻 一篇 arXiv 论文介绍了一个正在积极开发的 Rust GPU 卸载模块,目标是以可移植且安全的方式让 Rust 开发者直接在 GPU 上运行 Rust 代码,并默认提供高效的数据自动传输;未来还会提供更高级、可能不安全的接口以增强控制力。论文摘要称该模块尚未进入上游,社区讨论集中在技术路线和代码可用性上。目前没有源代码发布,因此这些设计仍处于提案阶段。 https://arxiv.org/abs/2608.13759
-
AI 生成的 Copilot 自动修复疑致 Snowflake Jira 遭入侵 — Horizon 评分 7.0/10 · 科技新闻 安全公司 Wiz 的 Red Agent 团队在 Snowflake 的 Jira 工作流中发现并利用了一个漏洞,根因被追溯到 GitHub Actions 脚本中由 GitHub Copilot 建议的“自动修复”代码。社区安全研究者指出,这属于 YAML 工作流中的模板注入/代码注入,例如 jira_issue.yml 中未安全地拼接标题与正文,可能导致恶意内容在 runner 中执行。这一事件说明,AI 辅助生成的 CI/CD 修复代码可能成为真实攻击面,仅靠人工审查难以发现这类问题,需要 zizmor 等静态分析工具作为防线。目前公开信息未表明该漏洞已被外部攻击者利用,具体影响范围也仍待披露。 https://www.wiz.io/blog/red-agent-snowflake-copilot-cicd-bug
-
Linux 内核 7.2 开发统计:提交数创历史第二高 — Horizon 评分 7.0/10 · 科技新闻 Linux 内核 7.2 于 2026 年 8 月 17 日由 Linus Torvalds 发布,整个开发周期共有 16,418 个非合并提交和近 60 万行新增代码,成为内核历史上第二繁忙的版本,仅次于主要由 bcachefs 合并主导的 6.7。共有 2,652 名开发者参与,打破了 7.1 的 2,479 人纪录;提交数最多的是 Uwe Kleine-König(151 个),按改动行数计则是 Matthew Stewart(83,587 行)。该版本还引入了 Rust zerocopy crate、MediaTek mt8196 声卡驱动以及大批 amdgpu 头文件。测试与评审标签方面,约 48% 的提交带 Reviewed-by、略超 8% 带 Tested-by,但评审标签比例近期呈轻微下降趋势。 https://lwn.net/Articles/1088776/
-
可引导构建:如何从零构建可信 Linux 用户空间 — Horizon 评分 7.0/10 · 科技新闻 在 2026 年于温哥华 UBC 举行的 FOSSY 大会上,Timothy Sample 介绍了可引导构建(bootstrappable builds)的原理与价值。可引导构建旨在从一个极小的种子程序开始,逐步构建出完整的现代 Linux 用户空间,从而不依赖任何预编译的二进制产物。与可复现构建相比,它主要应对信任问题,可防范 Ken Thompson “信任信任”攻击中那种在编译器或 strip 等自托管程序里隐藏后门的方式。Sample 提到 Guix 之前的引导停靠点是一个 250MB 的 GNU 用户空间静态链接 blob,并指出可引导构建还能带来软件自由方面的好处。 https://lwn.net/Articles/1088279/
-
宇树新机“超人”原地跳高 2 米 — Horizon 评分 7.0/10 · 科技新闻 宇树科技发布人形机器人新机“超人”的预告,宣称其原地跳高达 2 米、极限速度 12.66 米/秒(腿长 0.85 米),分别超过全人类原地跳高和奔跑速度纪录。官方称这台全新整机仅用 3 个多月研发完成,未来几个月仍有较大完善空间。目前信息以预告为主,尚未提供详细技术参数或实际演示数据,性能结论仍待正式发布验证。 https://m.weibo.cn/detail/5332901463070926
-
苹果调整 App 广告数据授权规则:第三方弹窗须中立,承诺七年 — Horizon 评分 7.0/10 · 科技新闻 苹果将调整 iPhone 和 iPad 上应用开发者使用个人数据投放定向广告的规则,以回应德国监管部门对其 App 追踪透明度框架(ATT)的竞争担忧。德国监管机构认定 ATT 对苹果自家应用更有利,涉嫌违反竞争规则,苹果须在裁决送达后四个月内落实新规,并承诺有效期七年。新规要求第三方授权弹窗保持中立,去除劝阻性措辞和符号。此前法国和意大利已分别就类似问题对苹果罚款 1.5 亿欧元和 9860 万欧元。这一调整将直接影响依赖广告变现的第三方开发者,并可能改变移动广告行业的授权流程。 https://www.reuters.com/business/retail-consumer/apple-change-app-data-consent-rules-german-regulator-says-2026-08-17/
-
Waymo 与特斯拉:两条自动驾驶技术路线 — Horizon 评分 9.0/10 · 科技博客 「背景」 自动驾驶要求系统在一秒内完成感知、预测、规划和控制,但真实交通里的罕见场景永远无法被团队预先列全。作者提出一个贯穿全文的框架:知识有多少在开发阶段被“写下来”并可以检查,又有多少在行驶中由模型“计算出来”而无法直接审查。 https://blog.bytebytego.com/p/waymo-vs-tesla-two-ways-to-build
-
AI 不会成为上帝,只会是一群天才 — Horizon 评分 8.0/10 · 科技博客 「背景」 作者从阿西莫夫《最后的问题》中逐步变成宇宙之神的计算机、斯科特·亚历山大笔下代表“多极陷阱”的摩洛克,以及阿莫代伊“数据中心里的天才之国”出发,提出一个关键问题:如果超级智能像今天的 LLM 一样由无数并行实例组成,它还能成为统一、无分歧的“机器神”吗? https://seangoedecke.com/help-peer/
数据来源:AI HOT (aihot.virxact.com) · 补充:Horizon Daily