Share these blogs with friends

2026

June

AI HOT 日报 · 2026-06-05

AI HOT 日报 · 2026-06-05 模型发布/更新 Nemotron 3.5 Content Safety:面向全球企业AI的可定制多模态安全 — Hugging Face:Blog(RSS) Nemotron 3.5 Content Safety基于Gemma 3 4B IT,提供128K上下文窗口,支持用户提示、可选图像与助手响应的统一多模态安全评估。新增自定义策略执行,允许企业用自然语言定义专属安全规则;THINK模式可输出可审计的逐步推理痕迹。显式训练覆盖12种语言,并借助基座模型零样本泛化至约140种语言。输出提供低延迟二分类、带分类标签、THINK推理痕迹三种模式。安全分类遵循Aegis 2.0框架(13核心类别+10细分类别)。同步发布多模态、多语言安全数据集,可在8GB+ VRAM GPU上实时部署。 https://huggingface.co/blog/nvidia/nemotron-3-5-content-safety Nex-N2-Pro 发布:基于 Qwen3.5 的 397B MoE 推理模型,性能达 GPT-5.5 水平 — X:硅基流动 SiliconFlow (@SiliconFlowAI) neolab 推出 Nex-N2-Pro,基于 Qwen3.5-397B-A17B,总参数 397B 的 MoE 推理模型,支持 262K 上下文与多模态(VLM),性能达到 GPT-5.5 和 Claude Opus 4.7 级别。模型可自动调节推理深度,减少 30-50% 思考 token 且无性能折损,在 Terminal Bench 2.1、GDPVal、SWE-Verified 上取得 SOTA。擅长智能体编码、深度搜索和工具使用,兼容 Claude Code、Cursor 等工具。硅基流动已提供 T+0 支持,前两周免费使用。 https://x.com/SiliconFlowAI/status/2062549952266723493 NVIDIA Nemotron 3 Ultra 为长时间运行的智能体带来更快、更高效的推理能力 — NVIDIA Technical Blog(开发者技术博客 · RSS) NVIDIA 发布 Nemotron 3 Ultra 模型,专为长时间运行的 AI 智能体设计。该模型能够在多轮对话中保持上下文、调用工具、调用子智能体,并高效处理复杂工作流。随着多智能体协作导致模型 token 数量快速增长,Nemotron 3 Ultra 通过优化推理流程显著提升速度并降低计算成本,使长期运行的智能体任务更加可行。 https://developer.nvidia.com/blog/nvidia-nemotron-3-ultra-powers-faster-more-efficient-reasoning-for-long-running-agents ...

June 5, 2026 · Liam DING

AI HOT 日报 · 2026-06-04

AI HOT 日报 · 2026-06-04 模型发布/更新 Grok Imagine 1.5 预览版发布 — X:cb_doge (@cb_doge) Grok Imagine 1.5 预览版已发布,即日起可在 API 中体验。SpaceXAI 正在发力。 https://x.com/cb_doge/status/2062242490745594085 MiniMax M3 1M token 解码加速 15.6 倍 — X:MiniMax (@MiniMax_AI) 15.6× faster decoding at 1M tokens 🔥 感谢 @FireworksAI_HQ 为 M3 提供推理支持。 立即尝试 👇 https://x.com/MiniMax_AI/status/2062316914618388758 Miso One 开源语音模型:8B 参数、110ms 延迟、一次语音克隆 — X:Kim (@kimmonismus) Miso One 正式发布,一个 8B 参数的开源权重语音模型(TTS),旨在模拟真实人类朗读的温暖与节奏。它支持一次语音克隆(只需短样本),推理延迟仅 110ms。模型权重已开源至 GitHub,无需 API 即可自托管,音频数据不离开本地。API 访问即将推出。演示已上线,可先试听再克隆仓库。 https://x.com/kimmonismus/status/2062210845308780639 Ideogram v4.0 发布:2K 分辨率和 JSON 提示支持 — X:Krea AI (@krea_ai) 介绍 Ideogram v4.0。 原生 2K 分辨率,出色的文字渲染,支持 JSON 提示词。 立即在 Krea 中体验。 https://x.com/krea_ai/status/2062227837130887567 ...

June 4, 2026 · Liam DING

AI HOT 日报 · 2026-06-03

AI HOT 日报 · 2026-06-03 模型发布/更新 微软首款高级推理AI模型MAI-Thinking-1发布 — The Verge:AI(RSS) 微软在Build 2026上发布了其首款高级推理AI模型MAI-Thinking-1。该模型被定位为“中等规模”,能在“关键”软件工程基准测试中达到领先模型的水平。微软称其完全从头使用干净数据进行训练,未涉及从第三方模型进行知识蒸馏。这标志着微软在自研AI模型上迈出重要一步,此前其主要依赖OpenAI。近期两家公司已重新协商合作协议,关系有所松绑。 https://www.theverge.com/tech/941664/microsoft-ai-model-reasoning-mai-thinking-1-build-2026 Holo3.1:快速本地计算机使用智能体 — Hugging Face:Blog(RSS) Holo3.1 是基于 Qwen 模型家族的计算机使用智能体系列,旨在提升在桌面、网页和移动环境中的鲁棒性。新模型提供 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次发布量化检查点,包括 FP8、Q4 GGUF 和 NVFP4,以优化本地推理。在 AndroidWorld 基准测试中,35B-A3B 模型得分从 67% 提升至 79.3%。在 DGX Spark 上,NVFP4 量化相比 BF16 实现 1.74 倍 token 吞吐量提升,并将平均步骤时间从 6.8 秒缩短至 3.3 秒。模型支持函数调用协议,可在第三方智能体框架中部署。 https://huggingface.co/blog/Hcompany/holo31 阶跃星辰Step 3.7 Flash发布,专为高效推理设计 — X:阶跃星辰 StepFun (@StepFun_ai) 阶跃星辰发布其推理优化型模型Step 3.7 Flash。该模型为196B MoE架构,从设计之初就专注于推理效率。其采用多矩阵分解注意力机制,使KV-cache成本仅为DeepSeek模型的约22%;同时通过注意力与FFN解耦技术,实现了硬件优化的高效服务。该模型已通过Fireworks AI提供,采用Apache 2.0许可,并可用于构建智能体应用。 https://x.com/StepFun_ai/status/2061655529731342402 产品发布/更新 Claude Code 新增动态工作流功能 — Claude:Blog(网页) Claude Code 新增动态工作流功能,允许模型在运行时即兴创建和协调多智能体框架来处理复杂任务。该功能通过执行特定的 JavaScript 文件来生成和协调拥有独立上下文窗口的子代理,可解决单一上下文窗口中长时间执行任务可能出现的智能惰性等问题。工作流适用于研究、安全分析、代码审查等场景,通常消耗更多 token,更适合高价值复杂任务,其最佳实践仍在发展中。 https://claude.com/blog/a-harness-for-every-task-dynamic-workflows-in-claude-code ...

June 3, 2026 · Liam DING

AI HOT 日报 · 2026-06-02

AI HOT 日报 · 2026-06-02 模型发布/更新 MiniMax M3:前沿编码、100万token上下文与原生多模态一体模型 — MiniMax:Blog(网页) MiniMax M3 是一个开源前沿模型,具备先进的编码与AI智能体能力。它支持100万token的超长上下文窗口,并采用名为MSA(MiniMax Sparse Attention)的新型稀疏注意力架构。该架构使模型在100万token上下文下的每token计算成本降至前代的1/20,预填充速度提升9倍以上,解码速度提升15倍以上。在SWE-Bench Pro编码基准上,MiniMax M3得分59.0%,超越GPT-5.5和Gemini 3.1 Pro,性能接近Opus 4.7。该模型可通过MiniMax Code、Token Plan和API服务使用。 https://www.minimax.io/blog/minimax-m3 xAI发布Composer 2.5 — xAI:News(网页) xAI的最新编程模型Composer 2.5现已在Grok Build中可用,用户可通过/models菜单选择使用。这是一款快速、先进的模型,擅长处理长时间运行的任务和复杂指令。该模型面向SuperGrok和X Premium+用户开放。 https://x.ai/news/composer-2-5 Qwen3.7-Plus:多模态智能体智能 — Qwen:Blog Retrieval(API) Qwen Studio 提供涵盖聊天机器人、图像与视频理解、图像生成、文档处理、网页搜索集成、工具使用及制品生成的全面功能。 https://qwen.ai/blog?id=qwen3.7-plus 使用NVIDIA Cosmos 3开发物理AI推理、世界与行动模型 — NVIDIA Technical Blog(开发者技术博客 · RSS) NVIDIA Cosmos 3是一款面向物理AI的前沿基础模型。它能够帮助机器人、自动驾驶车辆和智能空间理解真实世界、预测事件发展并生成适应特定环境与任务的行动。该模型融合了物理推理、世界理解与行动生成能力。 https://developer.nvidia.com/blog/develop-physical-ai-reasoning-world-and-action-models-with-nvidia-cosmos-3 SenseNova新模型解决AI图表生成难题 — X:商汤 SenseTime (@SenseTime_AI) 大多数AI模型在生成图表时存在数值错误(如负值显示为正)、柱状图位置偏移、元素关系混乱等问题。SenseNova-U1-8B-MoT-Infographic(SenseNova-U1)专为解决此类图表生成问题而设计,能够生成准确的图表,并支持实时调整设计和布局。项目在Hugging Face提供了模型,并在GitHub展示了效果案例。 https://x.com/SenseTime_AI/status/2061465029959209106 介绍 Mellum2:JetBrains 推出的 12B 混合专家模型 — Hugging Face:Blog(RSS) JetBrains 在 Hugging Face 发布博客,介绍其新发布的 Mellum2 模型。该模型采用混合专家架构,参数规模为 12B。 https://huggingface.co/blog/JetBrains/mellum2-launch ...

June 2, 2026 · Liam DING

AI HOT 日报 · 2026-06-01

AI HOT 日报 · 2026-06-01 产品发布/更新 OpenAI发布生物防御AI工具Rosalind — X:Sam Altman (@sama) 我们希望帮助世界在生物防御领域抢占先机: https://x.com/sama/status/2061101875303530871 DeepSeek V4 Flash 已上线 OpenCode Zen — X:opencode (@opencode) DeepSeek V4 Flash 现已在 OpenCode Zen 上线。 https://x.com/opencode/status/2061153857321775209 v2.1.159 — Claude Code:GitHub Releases(RSS) v2.1.159 版本更新包含内部基础设施改进,未引入任何面向用户的功能变更。此次更新预计不会影响现有功能或用户接口。 https://github.com/anthropics/claude-code/releases/tag/v2.1.159 行业动态 OpenAI正式进军机器人领域并启动招聘 — X:Sam Altman (@sama) OpenAI宣布成立OpenAI Robotics团队,并开始招聘全栈硬件、系统及ML工程师,以编程和制造能服务社会的机器人。该项目由Aditya Ramesh领导,其世界模拟研究计划已演变为机器人研究,强调硬件与ML研究的协同设计。短期目标是支持技术工人构建未来基础设施,长期愿景是为每个人提供个人机器人。 https://x.com/sama/status/2061117302528188712 苹果WWDC将推AI升级:Gemini蒸馏模型本地运行,但技术栈外部依赖显著 — X:Kim (@kimmonismus) 苹果下月WWDC将重点展示延迟已久的Siri及设备端AI升级,核心是在iPhone芯片本地运行从Google Gemini蒸馏而来的更小模型,以强调隐私与降低token成本。但该技术栈大部分源自外部:本地模型由Gemini蒸馏,设备无法处理的复杂查询将路由至Google Cloud处理,并采用了Nvidia的机密计算技术。苹果据称正在寻觅小型设备端AI初创公司以加速模型缩减工作。此外,苹果2024年承诺的Private Cloud Compute方案原计划使用苹果芯片,因无法承载完整Gemini模型,现已部分转向谷歌云,但该名称仍将保留。 https://x.com/kimmonismus/status/2061058117304262999 6000 多公里全程零干预:特斯拉 FSD 完成全球首次横穿加拿大自动驾驶 — IT之家(RSS) 一辆特斯拉汽车搭载 FSD V14.3.3 版本软件,完成了全球首次全程零人工干预、横穿加拿大的自动驾驶行程。车辆从温哥华出发,历时 4 天 21 小时,行驶 3760 英里(6051 公里)抵达哈利法克斯,全程所有驾驶操作(包括高速并线、应对复杂路况与自动泊车)均由系统自主完成,无任何系统退出或人工修正。该版本随 2026.14.6.6 更新推送,整合了春季软件功能。 https://www.ithome.com/0/957/718.htm ...

June 1, 2026 · Liam DING

May

AI HOT 日报 · 2026-05-31

AI HOT 日报 · 2026-05-31 模型发布/更新 Nano Banana Pro与Nano Banana 2正式发布 — X:Google AI for Developers (@googleaidevs) ICYMI:Nano Banana Pro [gemini-3-pro-image] 和 Nano Banana 2 [gemini-3.1-flash-image] 现已正式发布,可通过 Gemini API 投入生产使用。 查看这些优秀的社区示例,了解两个模型的实际能力 🧵 https://x.com/googleaidevs/status/2060685345738375640 小即是美:开源多模态模型发布 — X:阶跃星辰 StepFun (@StepFun_ai) 小即是美。😌 https://x.com/StepFun_ai/status/2060678753030947226 产品发布/更新 Show HN: Tiny-vLLM——基于 C 和 CUDA 的高性能大型语言模型推理引擎 — Hacker News 热门(buzzing.cc 中文翻译) Tiny-vLLM 是一个用 C 和 CUDA 编写的高性能大语言模型推理引擎,项目代码已开源至 GitHub。 https://github.com/jmaczan/tiny-vllm 行业动态 xAI放弃JAX GPU转向自研训练框架 — X:SemiAnalysis (@SemiAnalysis_) 突发新闻:JAX NVIDIA GPU & XLA:GPU最大客户刚刚宣布已放弃JAX GPU,宁愿用Grok Build“氛围编程”一个C训练框架。据报道xAI的JAX堆栈MFU低于10%。NVIDIA JAX团队过去两年全部主力996专注于支持xAI却失败了,我想他们现在可以休息并兑现期权了。 https://x.com/SemiAnalysis_/status/2060571944575963482 ...

May 31, 2026 · Liam DING

AI HOT 日报 · 2026-05-29

AI HOT 日报 · 2026-05-29 模型发布/更新 Claude Opus 4.8 发布:在编码、智能体技能与推理方面实现全面升级 — Anthropic:Newsroom(网页) Anthropic 发布了新一代模型 Claude Opus 4.8,作为 Opus 4.7 的升级版本,其在编码、智能体技能、推理和实用知识工作等各项基准测试中均取得进步。Claude Opus 4.8 现已可用,价格与前代相同。同步推出的新功能包括:用户可控制任务投入程度、Claude Code 新增“动态工作流”特性,以及 Opus 4.8 的 2.5 倍速模式价格降低为以往的三分之一。早期测试者反馈其在智能体任务中的判断力更可靠、工具调用更高效。该模型在 Online-Mind2Web 测评中得分 84%,超越了 Opus 4.7 和 GPT-5.5。此外,其诚实度与对齐表现也得到提升,代码错误漏检率降低了约 75%。 https://www.anthropic.com/news/claude-opus-4-8 Grok Build 0.1 on API — xAI:News(网页) xAI 的最新编码模型 Grok Build 0.1 已通过 xAI API 进入公开测试阶段。该模型专为智能体编码任务训练,支持网页开发、调试和 MCP,同时也是驱动 Grok Build CLI 的同一模型。其推理速度超过 100 tokens/秒,定价为输入 $1/m tokens,输出 $2/m tokens。除编码外,它也适用于通用智能体及工具调用场景,并可通过 OpenRouter 和 Vercel AI Gateway 获取。 https://x.ai/news/grok-build-0-1 ...

May 29, 2026 · Liam DING

AI HOT 日报 · 2026-05-28

AI HOT 日报 · 2026-05-28 产品发布/更新 Runway 推出 Model Context Protocol 服务器 — Runway:News(网页) Runway 正式推出 Runway MCP 服务器,允许任何兼容 MCP 的 AI 智能体(如 Claude、ChatGPT、Cursor)在对话界面中直接生成图像与视频,无需切换工作流。该服务器接入了 Runway 最新的多款 SOTA 模型,包括 Gen-4.5、Seedance 2.0、GPT Image 2、Kling 3.0 及 Nano Banana Pro。其应用场景涵盖为产品制作营销视频、批量生成网站视觉素材、创作角色广告以及在应用开发中集成视觉内容。用户设置简便,通过 runwayml.com/mcp 添加服务器并登录现有 Runway 账户即可使用,无需单独申请 API 密钥。 https://runwayml.com/news/mcp Claude Code v2.1.152 更新发布 — Claude Code:GitHub Releases(RSS) Claude Code 发布 v2.1.152 版本更新。核心改进包括:/code-review --fix 现在会将审查建议直接应用于工作目录;技能与斜杠命令支持通过 frontmatter 的 disallowed-tools 移除模型工具;新增 /reload-skills 命令可不重启会话重新扫描技能目录;SessionStart 钩子现可返回 reloadSkills: true 重新扫描技能,并可通过 hookSpecificOutput.sessionTitle 设置会话标题;新增 MessageDisplay 钩子事件以变换或隐藏助手消息。其他更新涉及插件市场管理、主模型不可用时自动切换至… https://github.com/anthropics/claude-code/releases/tag/v2.1.152 ...

May 28, 2026 · Liam DING

AI HOT 日报 · 2026-05-27

AI HOT 日报 · 2026-05-27 模型发布/更新 谷歌 AI 框架 AlphaProof Nexus 攻克 2 道悬置 56 年数学难题 — IT之家(RSS) https://www.ithome.com/0/955/261.htm 面壁智能开源 MiniCPM5-1B:在 AA-Index 上超越所有 2B 参数以下模型,能跑在手机、浏览器上 — IT之家(RSS) 面壁智能开源其新一代端侧大语言模型MiniCPM5-1B。该模型仅1B参数,在AA-Index榜单上超越所有2B参数以下模型,相比3个月前的Qwen3.5-2B效果更优且参数量减半。经INT4量化后权重仅0.5GB,支持在手机和浏览器上运行。其Base Model版本由面壁智能自主研发的AI训练框架ForgeTrain预训练完成,现已全面开源模型权重、训练数据集与部署方案。 https://www.ithome.com/0/955/267.htm 腾讯混元新翻译模型双榜亮眼,小程序发布 — X:腾讯混元 (@TencentHunyuan) 腾讯混元发布翻译模型 Hy-MT2,在 Hugging Face 开源模型趋势排行榜上表现突出:1.8B 版本排名第一,30B-A3B(MoE)版本排名第四,下载量已超 7K。官方同步推出了基于该模型的“腾讯混译”微信小程序,支持语音输入与离线翻译,并可自定义翻译风格与指令。模型代码与权重已开源。 https://x.com/TencentHunyuan/status/2059104921778352626 Qwen3.7-Max 成为全球第二AI编程模型 — X:阿里云 / Alibaba Cloud (@alibaba_cloud) Qwen3.7-Max 正式成为全球第二大 AI 编程模型。在 Code Arena 上得分 1541,仅次于 Claude。专为生产环境打造:可运行 35 小时任务、1000+ 次工具调用,并在数小时内交付两周的项目。 https://x.com/alibaba_cloud/status/2059163881361048011 产品发布/更新 MiMo 2.5 Pro大幅降价,与DeepSeek V4 Pro同价 — X:Kim (@kimmonismus) 小米MiMo-V2.5系列API价格永久下调,最高降幅达99%,现与DeepSeek V4 Pro同价。Token套餐同步升级,同等价格下可用token量增加5-8倍,计费规则更简单透明。所有现有用户套餐额度将全额重置。此次降价源于MiMo全栈推理优化与服务效率提升,后续将发布技术博客详述细节。MiMo-V2.5-TTS限时免费,新定价于5月26日生效。 https://x.com/kimmonismus/status/2059354372643975490 ...

May 27, 2026 · Liam DING

AI HOT 日报 · 2026-05-26

AI HOT 日报 · 2026-05-26 模型发布/更新 面壁智能联合清华等开源中国首个基于华为昇腾训练的 1.58-bit 端侧大模型 BitCPM-CANN — IT之家(RSS) https://www.ithome.com/0/954/759.htm 产品发布/更新 Grok Build Beta版向SuperGrok用户开放 — X:xAI (@xai) Grok Build 现已面向所有 SuperGrok 和 X Premium+ 用户推出 Beta 版。 使用 Plan Mode,通过 Imagine 创建图像和视频,并使用 CLI 构建自动化或编排器。 访问 http://x.ai/cli 开始使用。 https://x.com/xai/status/2058973760708091907 Qwen3.7-Max隐式缓存功能上线 — X:通义千问 / Qwen (@Alibaba_Qwen) ✅隐式缓存现已在Qwen3.7-Max上线——自动启用,无需设置。 ⚡️开箱即用,更快更便宜。 需要更高、更确定的命中率?请尝试显式缓存。🙌 🔗最佳实践🔗:https://www.alibabacloud.com/help/en/model-studio/explicit-cache-best-practice https://x.com/Alibaba_Qwen/status/2058932656797368619 行业动态 苹果据称正使用定制版1.2T参数Google模型重塑下一代Siri — X:Kim (@kimmonismus) 据报道,苹果为改造下一代Siri,正使用一个定制版、参数规模达1.2T的Google大模型作为其核心,这显著大于预估约300B参数的Gemini 3.5 Flash。该模型将驱动Siri的部分功能,其中简单查询预期会在本地设备运行。苹果面临的关键挑战是确保该大模型能够足够快速地响应日常问题。此外,下个月AI领域预计将有多项重要发布,包括WWDC上的Apple Intelligence与Gemini整合、GPT-5.6、可能的Sonnet 4.8/Opus 4.8,以及已确认的Gemini 3.5 Pro。 https://x.com/kimmonismus/status/2058997271803674991 教皇里奥呼吁在AI时代保持“深刻的人性” — The Verge:AI(RSS) 教皇里奥十四世在首份重要通谕《Magnifica Humanitas》中警告了AI及不受约束的技术力量带来的风险。该通谕于2026年5月15日发布,是教皇关于“在人工智能时代守护人”的宣言。文件重点讨论了AI驱动战争的危险、AI对劳动的影响,以及建立新的法律和伦理框架来规范技术的必要性,强调AI的快速普及正造成经济和社会动荡,对个人的保护不足威胁着人类尊严。 https://www.theverge.com/news/936945/pope-leo-letter-encyclical-ai-anthropic-labor-warfare OpenAI GPT-5.6 模型曝下月发布:AI 上下文 150 万 tokens — IT之家(RSS) 多名开发者在 OpenAI Codex 后端日志中发现未官宣的 GPT-5.6 模型,内部代号 iris-alpha。该模型将支持 150 万 token 的上下文窗口,较当前 GPT-5.5 的 105 万 token 提升约 43%,有望于今年 6 月发布。测试显示,在输入达到 90 万 token 时仍能流畅响应。同系列还发现了 ember-alpha 与 beacon-alpha 版本。此外,GPT-5.6 在前端界面生成能力上也有所提升。基于爆料信息,Anthropic Claude、Google Gemini 及 xAI Grok 也可能瞄准同期发布新模型。 https://www.ithome.com/0/955/078.htm ...

May 26, 2026 · Liam DING