AI HOT 日报 · 2026-08-15
2026-08-15 AI HOT 日报:共 15 条 AI 圈要闻,覆盖模型发布/更新、产品发布/更新、行业动态、技巧与观点,聚焦大模型发布、AI 产品更新与行业动态,每日更新。 📚 查看全部日报
模型发布/更新
-
dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理 — 公众号:小红书技术(dots.llm) 小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。 https://aihot.virxact.com/items/cmssv94cg0h4mroffsb9e7a88
-
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力 — 公众号:智谱(GLM) 智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。 https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
-
Gemini 3.7 Flash 全面上线 Pro 与 Ultra 用户 — X:Gemini (@GeminiApp) Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 也已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,让个人 AI 智能体更精准。 https://aihot.virxact.com/items/cmst9yj3c05utrodz443l0odv
-
DeepSeek V4 Pro 登陆硅基流动,1M 上下文 — X:硅基流动 SiliconFlow (@SiliconFlowAI) DeepSeek-V4-Pro-0813 正式上线硅基流动 SiliconFlow,提供 Day-0 支持,具备 1M 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 MIT 开源协议。定价为输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。同系列 DeepSeek-V4-Flash-0731 则面向追求速度与成本效益的日常生产场景。 https://aihot.virxact.com/items/cmssi38vn03o9rofffr0z8lyb
产品发布/更新
- Claude Code v2.1.233 发布:新增 GitLab MR 支持与内存 cgroup 限制 — Claude Code:GitHub Releases(RSS) Claude Code v2.1.233 发布,为 –worktree 标志和 agents 视图新增 GitLab 合并请求 URL 支持,并添加可选的 forward_user_identity 网关设置以按用户归因支出。 https://aihot.virxact.com/items/cmstjrtxi0a28ro0xbdowgrvf
行业动态
-
OpenAI and Anthropic in price war as Chinese AI rivals gain ground — Ars Technica:AI(RSS) 价格战让模型API的成本弹性成为现实,原先因账单压力转向中国厂商的用户,可能在OpenAI和Anthropic降价后重新比较能力与价格。 https://aihot.virxact.com/items/cmst2gs6d02lmro06sb7as7av
-
Cursor 正式被 SpaceX 收购 — Cursor Blog Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大 GPU 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现。 https://aihot.virxact.com/items/cmst3joqo03pwro0658o4g1m3
-
Claude 文本水印机制如何运作 — Anthropic:Newsroom(网页) 未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。 https://aihot.virxact.com/items/cmstc3u8j02xhro0xf5o1ouas
-
印尼首个大学AI中心落成:UGM、Indosat与NVIDIA合作培养本地AI人才 — NVIDIA Blog(RSS) 印尼通信与数字事务部、Indosat、NVIDIA与加查马达大学(UGM)在日惹共同启动UGM Indosat NVIDIA AI技术中心(NVAITC),这是该国首个大学AI技术中心。 https://aihot.virxact.com/items/cmst7s3xg02x3rodz3uvww36c
技巧与观点
-
2026年夏季开源模型生态观察:中国前沿模型规模领先,AMD与NVIDIA主导发布量 — Hugging Face:Blog(RSS) 2026年1至8月,Hugging Face公开模型仓库从243万增至296万,但85.6%的模型下载量不足200次,1.5%的仓库占据99.2%下载量。中国实验室月度最大开源模型参数规模在754B至2.78万亿之间,美国实验室七个月中五个月低于130B。AMD与NVIDIA各发布超200个新模型仓库,成为发布开源模型最多的机构。 https://aihot.virxact.com/items/cmst4z2qp05boro06ce7kxtgd
-
Claude Code 会话如何最大化 token 价值 — Claude:Blog(网页) Claude Code 的 token 成本由模型、输入/输出 token 和提示缓存三因素决定,输出 token 价格约为输入的 5 倍。任务间运行 /clear 可减少无关上下文回传,降低 token 用量;会话中途切换模型或 effort 级别会破坏提示缓存,增加成本。 https://aihot.virxact.com/items/cmst2fc5802f1ro062rp0wdez
-
蚂蚁百灵与 ASystem 团队打通单机 Agentic RL 后训练闭环 — 公众号:蚂蚁百灵(Ling) 蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 Agentic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定。 https://aihot.virxact.com/items/cmssf79uf05rwrod09r9ocb2w
-
OpenRouter 视觉指南:如何通过 API 向多模态模型发送图像 — OpenRouter:Announcements(RSS) OpenRouter 发布视觉指南,详解通过 Chat Completions API 向多模态模型发送图像的方法。请求体采用 messages 数组,用户消息的 content 包含 text 和 image_url 两部分,支持公开 URL 或 base64 数据 URL 两种格式,兼容 PNG、JPEG、WebP 和 GIF。 https://aihot.virxact.com/items/cmst8uvbr03l7rodzff6fiiml
-
谁真的需要SOTA模型?OpenRouter数据显示84%token来自非前沿模型 — Tomer Tunguz 博客(VC 分析) OpenRouter数据显示,84%的模型token并非来自SOTA模型,用户最常用的六款模型性能约为前沿模型的77%,成本仅为Claude Fable 5的2.5%。8月10日当周,六款模型承载了80%流量,混合价格约$0.50/百万token,而Fable 5为$20。最佳开源模型性能已从一年前的48%提升至前沿模型的80%,企业正转向更小、微调或开源模型以优化性价比。 https://aihot.virxact.com/items/cmstlse4t0bhbro0x08idymf2
-
Databricks 如何在数据仓库中使用 AI_Functions:主要用例解析 — Databricks:Blog(RSS) Databricks 探讨在数据仓库中应用 AI_Functions 的主要场景,帮助组织在结构化数据之外处理非结构化数据。文章聚焦于如何通过该功能将 AI 能力直接集成到 SQL 工作流中,以扩展数据仓库的分析边界。具体用例与实现细节以原文为准。 https://aihot.virxact.com/items/cmstgucbq067zro0xkuon9ioi
补充视野 · Horizon
来源:Horizon Daily(Thysrael 的 AI 聚合日摘)· 已与 AI HOT 去重,仅保留 AI HOT 未覆盖的条目
-
Qwen 3.8 27B 发布:开源模型本地推理获社区好评 — Horizon 评分 8.0/10 · 科技新闻 Qwen 3.8 27B 是一款新发布的开源权重语言模型,凭借较强的推理能力和本地运行表现引发广泛讨论。其提供 FP8 量化版本并支持 MTP(多 token 预测),有助于降低部署门槛。在社区测试中,该模型能通过某些私人推理基准,但处理同一任务消耗的 token 数约为对比模型的 5 倍,耗时较长;实际速度受硬件和推理引擎影响,例如在 RTX 5090 上搭配 ninfer 引擎可达约 138 tokens/s。虽然并非范式级突破,但它为本地模型生态提供了一个高价值的新选择。 https://huggingface.co/Qwen/Qwen3.8-27B-FP8
-
Firefox 成为最后仍支持 uBlock Origin 的主流浏览器 — Horizon 评分 8.0/10 · 科技新闻 随着基于 Chromium 的浏览器逐步因 Manifest V3 限制扩展能力,Firefox 现已成为唯一仍完整支持 uBlock Origin 的主流浏览器。这一变化标志着广告拦截生态的重要转折:uBlock Origin 这类依赖强大 WebRequest API 的扩展,在 Chrome、Edge 等浏览器上已无法以原有方式运行。Firefox 因此成为仍希望使用完整版 uBlock Origin 用户的主要选择,同时也凸显了浏览器厂商在隐私、广告过滤和扩展开放性上的分歧。 https://www.pcworld.com/article/3212428/firefox-is-now-the-last-major-browser-that-still-supports-ublock-origin.html
-
AI 机器人实验室年测 300 万人体组织,挑战动物测试 — Horizon 评分 8.0/10 · 科技新闻 据 Fast Company 报道,Vivodyne 在旧金山南部部署了 12 个“蜂巢”机器人实验室,利用 AI 设计实验并规模化培养人体组织,每年可对 300 多万个人体组织开展受控试验,宣传容量是美国全部临床试验总和的两倍。目前约 90% 的临床试验在通过动物测试后仍告失败,而该系统旨在用更接近人体、由 AI 驱动的组织测试来更好地预测新药疗效与安全性。这一规模尚属行业首次,但其能否真正替代动物测试仍有待独立验证。 https://www.fastcompany.com/91589344/the-worlds-largest-biological-datacenter-could-help-make-animal-testing-obsolete
-
小红书开源 dots3-note,280B MoE 仅 16B 激活 — Horizon 评分 8.0/10 · 科技新闻 小红书 dots 实验室开源了 dots3-note preview,这是 dots3 系列首个开放权重模型。模型总参数量达 280B,采用 MoE 架构,每次推理仅激活 16B 参数,支持 512K 上下文,并能处理文字、图片、视频和音频等多模态数据。该模型引入新的 TEMPO 强化学习方法,通过自批判和测试时价值估计训练长程智能体,已在 Hugging Face 上开放权重。官方还同步发布了 VibeSearchBench 和 VibeLifeBench 两个真实场景智能体基准,便于社区评估。 https://x.com/dotsstudioai/status/2088083314855018521
-
Opus 5 为何用起来更差:转向智能体导向的输出 — Horizon 评分 7.0/10 · 科技新闻 一位开发者撰文分析为何 Opus 5 的使用体验变差,认为模型在训练上越来越以智能体而非人类为目标,导致输出变成“智能体语言”,缺乏人类可读的优雅。社区讨论中,多位用户抱怨 Opus 5 写作过于省略、抽象,以及过度“诚实”和“忏悔”式的表达,令人疲惫。有用户因沟通成本转向 OpenAI 的 Sol,并称其“好相处得多”。该分析虽属主观体验,但引发关于大模型沟通风格和智能体化趋势的广泛讨论。 https://mun-logadan.github.io/why-does-opus-5-feel-worse/
-
RustDesk 在 Wayland 上实现真正无人值守远程访问 — Horizon 评分 7.0/10 · 科技新闻 RustDesk 现已支持在 Wayland 上实现真正的无人值守远程访问,改善了 Linux 用户的远程桌面体验。该更新解决了 Wayland 会话中无人值守访问此前较难实现的限制,对使用 Wayland 的用户而言是高价值改进。这属于增量更新而非突破性变化,但社区有实际需求,例如有用户表示两天前刚遇到相关问题。需要留意的是,RustDesk 自托管时仍不支持加密连接,这是一个已知限制。 https://rustdesk.com/blog/unattended-remote-access-wayland/
-
AI by Hand:动手理解 AI 模型数学原理 — Horizon 评分 7.0/10 · 科技新闻 AI by Hand 是 By Hand Research 的研究出版物,由 Tom Yeh 教授创办,通过“动手算”练习从数学和算法层面解释 AI 模型,帮助读者理解模型的可解释性与内部机制。该出版物提供免费文章并举办直播研讨会,订阅者可免费获取新文章,会员则可访问完整研究资料库。它不同于常见的工具使用教程,而是聚焦于模型底层原理,适合希望深入理解 AI 基础的学习者和研究者。社区讨论中,它也被推荐为从零构建 LLM 的相关阅读材料。 https://www.byhand.ai/
-
不分类,靠幻觉:用嵌入匹配 LLM 生成的假设标签 — Horizon 评分 7.0/10 · 科技新闻 Simon Willison 在 2026 年 8 月 14 日介绍了 Doug Turnbull 提出的“不要分类,要幻觉”方法,用来给自己博客里大量未打标签的旧文章补标签。Simon 的博客共有 1,856 个标签,数量太大,无法一次性全部提交给 LLM 并让它判断哪些标签匹配内容。该方法的要点是先让 LLM 在不看到现有标签表的情况下自由生成“从未见过”的假设分类,再用向量嵌入把这些假设分类映射到现有语料中最接近的具体标签。Doug 的示例提示还会给出标签的层级形状,例如“家具 / 客厅家具 / 咖啡桌与茶几 / 咖啡桌”,帮助模型生成更贴近实际体系的猜测。这样可以避免把完整标签表塞进提示词,同时保留已有标签体系。 https://simonwillison.net/2026/Aug/14/dont-classify-hallucinate/
-
谷歌被令一周内取消第三方应用商店安装障碍 — Horizon 评分 7.0/10 · 科技新闻 美国加州北区联邦地区法院法官 James Donato 在 Epic 诉谷歌反垄断案中下令,谷歌必须在一周内删除 Play Store 中安装第三方安卓应用商店前的多余步骤和警告弹窗,使安装过程与普通安卓应用一样直接。法院认为这些“查看”后才出现“安装”按钮等设计是蓄意的反竞争摩擦,意在吓退普通用户;此前陪审团已裁定谷歌在安卓应用分发上构成非法垄断。该命令直接影响 Google Play 对竞品应用商店的分发控制,是案件救济阶段的重要措施。 https://www.androidauthority.com/google-play-store-remove-third-party-app-store-friction-3698697/
-
PostgreSQL 修复 to_char 高危漏洞,可致任意代码执行 — Horizon 评分 7.0/10 · 科技新闻 PostgreSQL 项目披露高危漏洞 CVE-2026-14669,该漏洞存在于 to_char(timestamptz) 函数处理超长 POSIX 时区缩写的过程中,可引发堆缓冲区溢出,使能够设置时区的低权限数据库用户以 PostgreSQL 服务进程的操作系统权限执行任意代码,CVSS 评分为 8.8。受影响版本包括 18.5、17.11、16.15、15.19 和 14.24 之前的所有版本;由于 18.5 因回归问题未正式发布,18 系列用户应直接升级至 18.6,其他用户应分别升级至 17.11、16.15、15.19 或 14.24。此次修复属于小版本安全更新,不需要转储数据库或运行 pg_upgrade,只需更新程序文件并重启服务即可。 https://www.postgresql.org/support/security/CVE-2026-14669/
-
苹果联手阿里为中国训练专属 AI 大模型,有望成首个获批外企 — Horizon 评分 7.0/10 · 科技新闻 知情人士称,苹果已专门为中国市场训练一款大语言模型,并获阿里巴巴支持,改变此前依赖第三方模型的策略。Apple Intelligence 预计将在未来数月内随 iOS 更新在中国上线。中国网信办已于上月备案苹果的生成式 AI 服务,若落地苹果将成为首个获北京批准在华提供自有 AI 模型的外国公司。报道基于未具名消息源,缺乏技术细节。 https://www.reuters.com/business/retail-consumer/apple-trains-its-own-ai-model-china-market-with-alibabas-support-sources-say-2026-08-14/
-
伯克希尔二季度增持 Alphabet 至第三大重仓,并结束连续净卖出 — Horizon 评分 8.0/10 · 财经新闻 伯克希尔哈撒韦的二季度监管文件显示,公司大幅增持 Alphabet,使其成为第三大美股持仓,同时增持达美航空和房屋建筑商。截至 6 月底,Alphabet 持仓约 1.06 亿股、市值 379 亿美元,环比增加 83%;伯克希尔还结束连续 14 个季度净卖出,二季度净买入近 200 亿美元股票。 https://www.cnbc.com/2026/08/14/berkshire-hathaway-boosts-alphabet-to-a-top-three-holding-ups-delta-and-housing-bets.html
-
高盛参与英伟达、英特尔和 Alphabet 的大型 AI 融资交易 — Horizon 评分 8.0/10 · 财经新闻 高盛参与了三项大型 AI 融资安排:英伟达宣布由高盛等六家机构合力筹集 5000 亿美元用于 AI 基础设施建设,英特尔将 20 亿美元增发(最初为 15 亿美元)由高盛担任联席账簿管理人,Alphabet 的 850 亿美元增发(最初为 80 亿美元)也由高盛协助。除英特尔和 Alphabet 的增发为已公布的实际交易外,英伟达融资目前只有不具约束力的谅解备忘录,高盛的具体出资额和客户等细节尚未披露。 https://www.cnbc.com/2026/08/14/goldmans-latest-cash-cow-is-all-about-funding-the-ai-infrastructure-boom.html
-
苹果提交 App Store 外部购买抽成方案:最高 15% — Horizon 评分 8.0/10 · 财经新闻 苹果已向美国法院提交 App Store 外部购买抽成方案,费率最高为 15%:标准应用抽成 15%,视频、新闻等合作项目及订阅续费抽成 10%,小型企业计划应用抽成 5%。目前这仍是提案,还需等待 Epic 的回应及法院后续审理。 https://9to5mac.com/2026/08/13/apple-proposes-commissions-of-up-to-15-for-off-app-store-purchases-in-the-us/
数据来源:AI HOT (aihot.virxact.com) · 补充:Horizon Daily