AI HOT 日报 · 2026-10-09

2026-10-09 AI HOT 日报:共 22 条 AI 圈要闻,覆盖产品发布/更新、行业动态、论文研究、技巧与观点,聚焦大模型发布、AI 产品更新与行业动态,每日更新。 📚 查看全部日报

Crowdstrike 报告疑似单人使用 AI 渗透工具攻击多家韩国银行 Crowdstrike 报告称,一名疑似中文使用者于2026年9月底至10月初利用 AI 驱动的开源渗透测试工具 ARTEX 攻击多家韩国金融机构,窃取大量数据,其中 Shinhan Bank 超过 25,000 条包含姓名、联系方式、收入和信用额度的记录泄露。

产品发布/更新

  1. Claude 推出 Dashboards 实时仪表盘与 Motion 动画讲解功能 — Claude:Blog(网页) Anthropic 发布 Claude Dashboards 和 Claude Motion 两项 beta 功能。 https://aihot.news/items/winsvtlfubhjfi0wnone83j5c

  2. Anthropic 推出开源漏洞扫描服务 OSS Scanner,免费面向开源项目 — Anthropic:Research(发表成果 · 网页) Anthropic 发布 OSS Scanner,一个可选加入的开源漏洞扫描服务,用其最强模型(包括 Claude Mythos)定期免费扫描开源项目,输出为全模型生成、无人工复核的报告。 https://aihot.news/items/xfch7s2npl8a4651n2ymips4k

  3. ts-rust 发布:由 LLM 将 TypeScript 编译器、检查器和 LSP 移植到 Rust — Hacker News:AI 热帖 ts-rust(tsc-rs)将 microsoft/TypeScript(Go 实现)的编译器、类型检查器和语言服务器移植为 Rust,作者称全部代码由 LLM 编写,本人未读过代码。 https://aihot.news/items/yyba9bpxdtqdpqmv739d26ftg

行业动态

  1. Crowdstrike 报告疑似单人使用 AI 渗透工具攻击多家韩国银行 — The Decoder:AI News(RSS) Crowdstrike 报告称,一名疑似中文使用者于2026年9月底至10月初利用 AI 驱动的开源渗透测试工具 ARTEX 攻击多家韩国金融机构,窃取大量数据,其中 Shinhan Bank 超过 25,000 条包含姓名、联系方式、收入和信用额度的记录泄露。 https://aihot.news/items/br6vb46mhi9mkv2pxiq59k8z7

  2. OpenAI 年化营收被曝接近 500 亿美元,与此前预期差距约 200 亿美元 — IT之家·人工智能 据金融时报报道,OpenAI 向投资者披露截至 9 月底年化营收逼近 500 亿美元,大幅低于此前外界估算的 700 亿美元,缺口约 200 亿美元。差异源于统计口径不同,Anthropic 计入 AWS 和谷歌云等合作方销售收入,而 OpenAI 剔除该部分。报道发布后美股科技股下跌,纳斯达克 100 指数收跌 1.4%,英伟达跌 2.9%,甲骨文跌 5.5%。 https://aihot.news/items/b2mwouqv4jhfj70uho7s7guti

  3. 部分数学家呼吁抵制 OpenAI,AI 生成的数学证明涌入数学领域 — The Decoder:AI News(RSS) AHM 组织在 Terence Tao 主持下发表声明,呼吁抵制 OpenAI,称其一次性发布 700 多个 AI 生成证明文件是展示力量而非学术行为。此前 OpenAI 宣称内部模型一个月内解决逾 100 个开放数学问题,约 8000 个测试问题成功率约 5%,平均每个耗时 3 小时 GPT-Pro 级算力。 https://aihot.news/items/wf099r75jv1tzyhxa2j2o8n1p

  4. Anthropic 发布 2026 年使用政策更新,11 月 12 日生效 — Anthropic:Newsroom(网页) Anthropic 发布新版使用政策,将于 11 月 12 日生效,多数变化是对既有规则的澄清。更新包括新设禁止欺骗性活动章节、收窄选举条款、明确武器软件与无人机武装禁令、更精确的监控与执法限制、补充高风险用例及自主物理操作的 human in the loop 要求,并新增禁止对模型的持续无端虐待行为。 https://aihot.news/items/at5dvel8balkaba9wrggcrqoj

  5. Codex 与 ChatGPT Work 活跃用户达 4000 万新高,付费账户重置已全部到账 — X:Tibo (@thsottiaux) 作者确认 banked reset 已到账所有账户,并转引 Day 3 动态称 Codex 与 ChatGPT Work 合计活跃用户达到 4000 万新高,其中提到 GPT-6 已在 Chat 中上线。 https://aihot.news/items/zdgw2hhfjitur1qmeuminh3lm

  6. OpenAI 封禁俄罗斯与伊朗两个利用 ChatGPT 开展虚假前臆影响行动的账号集群 — OpenAI:官网动态(RSS · 排除企业/客户案例) OpenAI 封禁了两个隐蔽影响行动,俄罗斯来源的 Dark Clark 通过假 persona Mia Clark 控制拉美智库 Social Research Center,评分达 Category 5,是报告以来首个 Category 5;伊朗来源的 Bogus Bylines 用 7 个假记者身份在全球十几家中小媒体投放近 100 篇长文,评分 Category 4。 https://aihot.news/items/b33i6chgxghls2v7bng0wr0nr

  7. Waymo 完成 50 亿美元债务融资,加速业务扩张 — Waymo:Blog(网页) Waymo 宣布完成 50 亿美元定期贷款,这是其首次债务融资。PIMCO、Blackstone 和 Sixth Street 担任牵头银团贷方,Goldman Sachs 担任独家主账簿管理人;资金将用于加速其全自动驾驶打车服务在美国及国际市场的扩张。此前今年早些时候 Waymo 完成了 160 亿美元股权融资,上个月刚在第十五个美国城市启动服务。 https://aihot.news/items/pl2oa5clmf0gp3t7x3qsn71kc

论文研究

  1. Goodfire 为 Kimi K3 和 GLM 5.3 训练并部署生产级网络安全监控器 — Goodfire Research(网页) Goodfire Research 为 Kimi K3 和 GLM 5.3 构建基于激活探针加 LLM judge 的监控级联,并部署到生产推理栈。 https://aihot.news/items/ja19mtm89yojd9w2u67qp1gqv

技巧与观点

  1. Hugging Face 工程师用 ML Intern 以约 103 美元自制 7 个小模型 — Hugging Face 官方团队博客 Hugging Face 工程师 yuvraj sharma 用 HuggingChat 的 ML Intern 模式在几天内做出 7 个模型,包括可在 CPU 运行、99.7% 有效输出的 0.8B 提示词重写器,以及将柑橘病害识别准确率从 14.9% 提升到 52.8% 的 Qwen3.5-2B 微调模型等,全部计算成本约 103 美元。 https://aihot.news/items/ylkp4aqm4r5fn7aul2l9kfmxw

快讯

  1. Arena 公布 Claude Haiku 5.5 (High) 真实评测结果:Code Arena 1587 分首秀第 30 名 — X:Arena (@arena)
  2. Zenity 研究人员发现一条提示词即可劫持 AWS 账户内全部 AgentCore 智能体 — The Decoder:AI News(RSS)
  3. Artificial Analysis 评测 Google Nano Banana 2.1,两榜居第 4 且价格为前代一半 — X:Artificial Analysis (@ArtificialAnlys)
  4. Google 开源 ML Drift 端侧 GPU 推理引擎,接替 TFLite GPU delegate — Google Developers Blog(RSS)
  5. Arena 完成 2 亿美元 B 轮融资,估值 31 亿美元并发布 Alignment Index — X:Arena (@arena)
  6. GPT-6.1 Sol ultrafast 发布,Codex steering 改进为即时响应 — X:Tibo (@thsottiaux)
  7. Anthropic 用 Claude Managed Agents 构建定时智能体自动化的实践指南 — Anthropic:Claude.dev 开发者博客(RSS)
  8. Tessl 工程博客:AI 不是笨,是瞎——企业级 Agent 记忆的三个关键设计决策 — Tessl:产品与工程博客
  9. Google 开源 AQuA 环境质量智能体,自动诊断生产环境中的 Agent 故障 — Google Developers Blog(RSS)
  10. Claude 九月回顾:Chat 与 Cowork 合一,Claude 5.5 系列模型上线 — Claude:YouTube(RSS)

补充视野 · Horizon

来源:Horizon Daily(Thysrael 的 AI 聚合日摘)· 已与 AI HOT 去重,仅保留 AI HOT 未覆盖的条目

  1. 中国团队实现钍-229 核光钟稳定运行 — Horizon 评分 8.0/10 · 科技新闻 清华大学研究团队利用自主研制的 148 纳米连续波真空紫外激光和掺钍-229 氟化钙晶体,报告研制出核光钟并实现稳定运行,成果发表于《自然》。该时钟以钍-229 原子核能级跃迁为计时基准,有望成为新一代时间频率基准。这是研究团队在《自然》论文中报告的实验结果,尚非已部署的计时标准。 https://www.nature.com/articles/s41586-026-11122-1

  2. DeepSeek 4.1 Flash 为何未引发行业恐慌 — Horizon 评分 7.0/10 · 科技新闻 一篇 dgt.is 博客文章与随后的 Hacker News 讨论提出疑问:DeepSeek 4.1 Flash 推出后,为什么没有像其他前沿模型那样引发业界警觉。评论者给出的主要解释是,多数用户实际使用的是厂商大幅补贴的订阅套餐,而按 OpenRouter 等平台的 API 价格直接调用并不便宜——有评论者称几天就花掉了 50 美元。另一条线索是开放权重模型对显存的要求:评论者列举出 FP16 约 1664 GB、INT8 约 832 GB、INT4 约 416 GB,但这些数字以及该模型的具体规格在讨论中都没有官方来源。 https://www.dgt.is/blog/2026-10-07-deepseek-freek-out/

  3. Linux 内核 vswap 与 xswap 的 swap 虚拟化方案分歧未决 — Horizon 评分 7.0/10 · 科技新闻 Linux 内核交换层中 swap cache 槽位与持久 swap 文件空间直接绑定的问题仍未解决,Nhat Pham 的 vswap 与 Baoquan He、Chris Li 的 xswap 两个竞争方案都尚未达到可合并状态。问题核心在于,zswap 中的每个 folio 仍必须在持久 swap 设备上占用一个槽位,即使该空间通常用不到,这会让大型数据中心为实际不落盘的数据预留大量闪存。vswap 在现有 swap 设备上增加虚拟化层,用 xarray 跟踪可映射到物理 swap 文件、zswap 或无槽位的虚拟槽位,并且其 swap 区域可随负载动态伸缩;xswap 则提供一个没有后备存储的虚拟 swap 设备,用稀疏映射地址范围做簿记,但要求一开始就预留完整地址空间,因而限制设备最大容量和 zswap 可存放的 folio 数。关于合并顺序的讨论未达成结论,He 最近发布了三部分的新 xswap 实现,其中第 2 部分补上了此前缺失的物理回写,讨论仍在继续。 https://lwn.net/Articles/1098399/

  4. 人社部就新就业形态劳动者权益保障办法公开征求意见 — Horizon 评分 8.0/10 · 财经新闻 10 月 8 日,人力资源社会保障部发布《新就业形态劳动者权益保障办法(征求意见稿)》,即日起至 11 月 8 日公开征求意见,适用对象包括网约车司机、外卖骑手、网络主播等新就业形态劳动者。征求意见稿提出正常劳动报酬不得低于当地最低工资标准、连续工作 4 小时应保障适当休息,并要求停止派单、封禁账号等重大决定须经人工审核、不得由算法自动作出,同时明确不得滥用罚款等惩罚性措施。 https://mp.weixin.qq.com/s/saqkOXlhe0wX7qD83vdkRw

  5. 美政府以欺诈指控暂停微软绿卡申请资格 — Horizon 评分 8.0/10 · 财经新闻 特朗普政府宣布暂停微软参与外籍劳工绿卡申请项目,理由是欺诈指控;副总统万斯称微软去年裁员 6000 名美国员工,却获得 6300 份 H-1B 签证和近 3000 张绿卡,并指责其先发布虚假招聘广告再以外籍劳工替换美国员工。微软尚未回应,上述欺诈说法目前仍属政府一方的指控,未经证实。 https://apnews.com/article/h1b-visa-program-vance-microsoft-e7b3a407f822702b269ee277d21343ea


数据来源:AI HOT (aihot.virxact.com) · 补充:Horizon Daily