Share these blogs with friends

2026

June

AI HOT 日报 · 2026-06-15

AI HOT 日报 · 2026-06-15 行业动态 Anthropic 暂停新模型访问,印度辩论 AI 未来 — TechCrunch:AI(RSS) Anthropic 暂停了新模型的访问权限,印度科技领袖围绕这一事件展开辩论,探讨其是否是对该国 AI 雄心的警示。 https://techcrunch.com/2026/06/13/as-anthropic-suspends-access-to-new-models-india-debates-its-ai-future Meta 开始撤销 20 亿美元收购 Manus 的交易 — TechCrunch:AI(RSS) 据 TechCrunch 报道,Meta 已开始撤销对 Manus 的 20 亿美元收购交易,此前北京要求该交易必须反转。目前收购解除程序已启动。 https://techcrunch.com/2026/06/13/meta-reportedly-moves-to-unwind-2b-manus-deal-after-beijings-demand 技巧与观点 乔木小说创作 Skill 开源发布 — X:Vista (@vista8) 开源乔木小说创作 Skill,用户只需说“我想写一个小说”或指定风格,AI 自动生成剧情梗概、人物设定、钩子、经典桥段、人物欲望、冲突升级和结尾。与 AI 讨论确认后,可生成完整、低 AI 味的小说。安装命令:npx skills add joeseesun/qiaomu-novel-generator,Github 开源地址见评论区。 https://x.com/vista8/status/2066165703443726749 Anthropic 上市前夕 — X:小互 (@xiaohu) Anthropic CEO Dario Amodei透露内部模型Mythos有上千漏洞,能黑银行、窃取国家机密;预言AI一到五年内砍掉一半入门级白领工作;称Claude已被美军用于对伊朗战争,涉及女校150人死亡拷问;解释离开OpenAI因信任崩塌;回怼黄仁勋末日营销指控;给出文明崩溃概率10%-25%。 https://x.com/xiaohu/status/2065991805238497732 白宫AI监管决定被指偏袒OpenAI与亚马逊 — Gary Marcus:The Road to AI We Can Trust(RSS) 白宫周五做出的AI监管决定被指偏袒OpenAI、亚马逊等企业,同时对Anthropic施压不足24小时,缺乏透明度和事实依据。Gary Marcus、Dean W Ball及卡托研究所Kevin Frazier等专家指出,这种由少数人闭门快速决策的做法带有腐败嫌疑,可能促使其他国家加速发展“主权AI”甚至中国AI,并导致美国人才流失。Anthropic声明称政府应在法定程序中基于技术事实阻止不安全部署,而非当前方式。Marcus呼吁建立独立机构负责AI监管,确保公平、清晰、基于证据的执行。 https://garymarcus.substack.com/p/what-washington-must-do ...

June 15, 2026 · Liam DING

AI HOT 日报 · 2026-06-14

AI HOT 日报 · 2026-06-14 模型发布/更新 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 — 公众号:智谱(GLM) GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,在长程任务中继续保持领先,并被智谱称为最强的国产 Coding 模型。今晚 5:21 起面向 GLM Coding Plan 全量用户开放(覆盖 Lite、Pro、Max、团队版)。API 将于下周上线,模型下周正式开源,遵循 MIT 协议。 https://mp.weixin.qq.com/s/LDrbtLM0wiCTJorvd5GY9w 产品发布/更新 Suno 音轨分离:从零生成更纯净 — X:Suno (@suno) 重大更新:Suno 的音轨分离刚刚大幅升级。🚀 我们现在从零重新生成音轨,而非仅仅隔离频率。结果如何?纯净无伪影的音轨,可直接拖入你的 DAW。 https://x.com/suno/status/2065862499765821916 Fusion API:半价达Fable级智能 — X:OpenRouter (@OpenRouter) 推出Fusion API,市场上最智能的复合模型。 Fusion以一半的价格实现Fable级别的智能。 工作原理如下👇 https://x.com/OpenRouter/status/2065856853989270011 行业动态 Anthropic的安全警告可能适得其反——政府已撤回其最强大AI — TechCrunch:AI(RSS) Anthropic对政府撤回其最强大AI模型表达不满,称仅基于一个狭窄的潜在越狱发现就召回已部署给数亿用户的商业模型不合理。 https://techcrunch.com/2026/06/12/anthropics-safety-warnings-may-have-just-backfired-the-government-has-pulled-the-plug-on-its-most-powerful-ai 谷歌Android安全负责人因反对军事AI合作辞职 — IT之家(RSS) 谷歌Android平台安全负责人René Mayrhofer辞职,他在5月18日内部告别信中指责公司“丧失道德指针”,批评谷歌悄悄放弃碳中和目标(因AI模型能耗),并与美国战争部签署允许AI用于“任何合法目的”的协议。今年4月下旬谷歌宣布向五角大楼提供AI用于机密工作,2025年2月更新AI原则时移除了不使用AI开发武器或监控工具的承诺。Mayrhofer担忧谷歌AI产品可能被用于针对公民的大规模监控,包括自己和家人。 https://www.ithome.com/0/963/888.htm Anthropic 秘密申请上市,估值 9650 亿美元 — Bloomberg:Technology(RSS) Anthropic,这家估值达 9650 亿美元的 AI 巨头、史上增长最快的初创公司之一,在秘密提交 IPO 申请后,再次投下重磅炸弹。 https://www.bloomberg.com/news/articles/2026-06-13/global-capitalism-bets-it-all-on-ai-future-that-alarms-voters ...

June 14, 2026 · Liam DING

AI HOT 日报 · 2026-06-13

AI HOT 日报 · 2026-06-13 模型发布/更新 MiniMax M3 开源权重模型发布,已上架 HuggingFace — X:MiniMax (@MiniMax_AI) MiniMax 发布开源权重模型 M3,约 428B 总参数、23B 激活参数,已上传 HuggingFace。该模型融合三种前沿能力:编码与智能体方面达 59.0% SWE-Bench Pro、66.0% Terminal Bench 2.1、34.8% SWE-fficiency、28.8% KernelBench Hard、74.2% MCP Atlas;采用 MiniMax 稀疏注意力将上下文窗口扩展至 1M token;原生多模态。同步上线 MiniMax Code 工具及 API 平台。权重与技术报告预计约 10 天后发布。 https://x.com/MiniMax_AI/status/2065436935188058208 Kimi 发布并开源最新代码模型 Kimi-K2.7-Code — X:Kimi.ai (@Kimi_Moonshot) Kimi 发布并开源最新代码模型 Kimi-K2.7-Code。相比 K2.6,其在 Kimi Code Bench v2 上提升 +21.8%,Program Bench 提升 +11.0%,MLS Bench Lite 提升 +31.5%。推理效率改进,推理 token 使用量降低 30%,长时编码任务中指令遵循和端到端成功率均提升。6x 高速模式即将推出,即日起可通过 Kimi API 和 Kimi Code 使用。 https://x.com/Kimi_Moonshot/status/2065377579130142937 ...

June 13, 2026 · Liam DING

AI HOT 日报 · 2026-06-12

AI HOT 日报 · 2026-06-12 模型发布/更新 Gemini Omni Flash 视频任务达 SOTA — X:Logan Kilpatrick (@OfficialLoganK) Gemini Omni Flash 在图像到视频、文本到视频和视频编辑方面达到了 SATA : ) 很高兴很快能将这一能力通过 API 提供给开发者! https://x.com/OfficialLoganK/status/2065118111360303414 Midjourney V8.1 已成为默认模型 — Midjourney:Updates(RSS) Midjourney 已将默认模型从 V7 升级为 V8.1。V8.1 在智能性、连贯性、对详细提示的遵循度以及文本渲染效果上均有提升,HD 模式也已支持。 https://updates.midjourney.com/v8-1-is-now-the-default-model 产品发布/更新 腾讯混元 AI Infra 新开源:HPC-Ops 推理核心算子全面升级 — 公众号:腾讯混元 腾讯混元 AI Infra 团队开源升级 HPC-Ops 推理算子库,推出五大核心算子。Attention 采用运行时动态负载调度,长文本最高加速 2.95x,端到端 QPM 提升 17%;Router GEMM 以双 BF16 组合实现 FP32 精度,对比 CuBLAS FP32 最高提速 3.22x;FusedMoE 相对 vLLM、SGLang 性能提升 1.2x~1.6x;Fused AllReduce+Norm 对比主流方案最高提速 1.68x;Sampler 将解码采样融合为 2 个 CUDA Kernel,相对 vLLM 提速 4.0x~7.5x。所有能力均来自生产实践并完全开源。 https://mp.weixin.qq.com/s/y0vd1cpvWXLSssL1kXxguw ...

June 12, 2026 · Liam DING

AI HOT 日报 · 2026-06-11

AI HOT 日报 · 2026-06-11 模型发布/更新 DiffusionGemma:文本生成速度提升4倍的开源扩散模型 — Google DeepMind:Blog(RSS) Google DeepMind 发布开源实验模型 DiffusionGemma,采用文本扩散技术,突破自回归逐 token 生成方式,每次前向并行生成 256 个 token。该 26B MoE 模型推理时仅激活 3.8B 参数,量化后适配 18GB 显存消费级 GPU。在 H100 上达 1000+ tokens/s,RTX 5090 上 700+ tokens/s,速度提升 4 倍。具备双向注意力和自我修正能力,面向内联编辑、代码填充等本地交互工作流,以 Apache 2.0 许可证开放。 https://deepmind.google/blog/diffusiongemma-4x-faster-text-generation Grok Voice性能出色价格低廉 — X:xAI (@xai) Grok Voice 提供最先进的性能,具有类人的时机、语调和温暖感。而且价格仅为竞争对手的一小部分。 查看详情:http://x.ai/api/voice https://x.com/xai/status/2064777588036530309 产品发布/更新 小米发布 MiMo Code V0.1 开源终端 AI 编程助手 — X:小米 MiMo (@XiaomiMiMo) 小米推出开源终端 AI 编程助手 MiMo Code V0.1,附带限时免费使用的多模态模型 MiMo V2.5,支持百万 token 上下文窗口。核心特性包括:无限上下文(自动知识积累与无损压缩)、Agent-模型深度协同(测试-审查-验证闭环)、Compose 模式(规格→计划→构建→报告)、自进化系统、语音输入(基于 MiMo-V2.5-ASR)、兼容 Claude Code(零成本迁移),以及 MIT 许可、支持 Anthropic、OpenAI、DeepSeek、Kimi、GLM 等主流模型提供商。 https://x.com/XiaomiMiMo/status/2064772356443394441 ...

June 11, 2026 · Liam DING

AI HOT 日报 · 2026-06-10

AI HOT 日报 · 2026-06-10 模型发布/更新 Claude Fable 5 和 Claude Mythos 5 — Anthropic:Newsroom(网页) Anthropic 今日推出 Claude Fable 5(通用安全版)和 Claude Mythos 5(受限安全版)。Fable 5 在软件工程、知识工作、视觉、科研等几乎所有测试基准上达到 SOTA,Stripe 称其将数月工程压缩至数天,FrontierCode 评分居前沿模型之首,可仅凭截图重建网页应用源码。Mythos 5 在药物设计中实现约 10 倍加速,其分子生物学假说盲测获科学家偏好的概率约 80%。两模型售价均为 $10/百万输入 tokens、$50/百万输出 tokens,较 Claude Mythos Preview 降价过半。Fable 5 在部分敏感主题上回退至 Claude Opus 4.8,安全触发… https://www.anthropic.com/news/claude-fable-5-mythos-5 Google DeepMind 发布 Gemma 4 12B:统一的无编码器多模态模型 — Google DeepMind:Blog(RSS) Gemma 4 12B 是 Google DeepMind 最新推出的中等规模多模态模型,采用无编码器统一架构,原生支持音频输入。其基准测试性能接近 26B MoE 模型,但内存占用不到一半,仅需 16GB 显存或统一内存即可在消费级笔记本上本地运行。模型内置多 token 预测(MTP)drafter 以降低延迟,基于 Apache 2.0 开源许可发布,已累计超过 1.5 亿次下载。 https://deepmind.google/blog/introducing-gemma-4-12b-a-unified-encoder-free-multimodal-model ...

June 10, 2026 · Liam DING

AI HOT 日报 · 2026-06-09

AI HOT 日报 · 2026-06-09 模型发布/更新 小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型 — X:小米 MiMo (@XiaomiMiMo) 小米 MiMo 联合 TileRT_AI 发布 MiMo-V2.5-Pro-UltraSpeed,首次在 1 万亿参数 MoE 模型上实现超过 1,000 tokens/s 输出速度,仅用单台标准 8-GPGPU 节点(非 Cerebras 或 Groq 方案)。提供限时免费聊天体验,UltraSpeed API 价格为 3 倍,输出体验提升约 10 倍。申请时间为 6 月 8 日至 23 日(PDT),企业可邮件联系 [email protected]。 https://x.com/XiaomiMiMo/status/2063993790587904362 苹果发布第三代 Apple Foundation Models(AFM) — Apple Machine Learning Research(RSS) 苹果推出第三代 Apple Foundation Models(AFM)基础模型家族,与 Google 合作定制,包含五个模型,覆盖从设备端到基于 Private Cloud Compute 的服务器端模型。这些模型旨在驱动 Apple Intelligence 功能,包括全新 Siri 和智能工具,以用户为中心深度融合操作系统,隐私为核心设计原则。 https://machinelearning.apple.com/research/introducing-third-generation-of-apple-foundation-models ...

June 9, 2026 · Liam DING

AI HOT 日报 · 2026-06-08

AI HOT 日报 · 2026-06-08 模型发布/更新 Harness-1:基于强化学习训练的有状态搜索20B检索子智能体 — MarkTechPost(RSS) UIUC与Chroma联合推出Harness-1,一个20B参数的检索子智能体。它通过强化学习在一个有状态搜索框架中训练,该框架维护候选池、重要性标注集、证据图和验证记录,由策略决定搜索、筛选、验证及停止的时机。Harness-1在8个基准测试上达到0.730平均curated recall,比下一个最佳开源子智能体高出11.4个百分点,仅落后于Opus-4.6。模型权重和框架代码均已公开。 https://www.marktechpost.com/2026/06/06/meet-harness-1-a-20b-retrieval-subagent-trained-with-reinforcement-learning-inside-a-stateful-search-harness-on-gpt-oss-20b 产品发布/更新 Her · हेर — Claude Code 会话分析工具 — Hugging Face:Blog(RSS) Her(हेर)是专为 Claude Code 设计的会话分析工具。用户上传 .jsonl 文件后,Her 用自然语言重建每轮交互,标记部署、配置变更、秘密等高风险操作并定位到具体轮次。它展示 token 消耗、所用工具、子智能体、技能和 MCP 服务器,并结合 Anthropic 与社区最佳实践给出改进建议(仅在有明确可修复模式时)。内置“Ask Her”问答功能,支持单会话与跨会话项目分析。工具不调用第三方 AI API,使用 Nemotron-Mini-4B-Instruct 模型在 Hugging Face ZeroGPU 上运行,评估引擎完全确定,模型仅负责文本生成与建议。Her 内置 Homebrew、npm、PyP… https://huggingface.co/blog/build-small-hackathon/her-blog Opus 4.8 缓存命中率与有效价格可实时查看 — X:OpenRouter (@OpenRouter) 不同模型提供商在缓存命中率和有效价格上有什么差异? 现在你可以从 Pricing 标签查看实时缓存命中率和历史流量。这里是 Opus 4.8:https://openrouter.ai/anthropic/claude-opus-4.8/pricing https://x.com/OpenRouter/status/2063504950429147376 NVIDIA 与 KRAFTON、NC、T1 在韩国 PC 房庆祝 RTX Spark 发布 — NVIDIA AI Blog 继上周 GTC Taipei 发布后,NVIDIA CEO Jensen Huang 前往韩国,向当地游戏社区正式介绍 RTX Spark 超芯片。该芯片集成 30 年 NVIDIA 技术,可在 Windows 笔记本上实现全天续航,并以 1440p 分辨率、超过 100fps 运行 AAA 游戏,支持包括 DLSS 4.5 Ray Reconstruction(基于第二代 Transformer 模型)在内的全套 RTX 技术。KRAFTON、NC 与 Riot Games 正合作将旗下游戏适配 RTX Spark。周五,Huang 在 T1 电竞场馆与 Faker 共同亮相,并突袭江南区网吧,演示《PUBG: BATTLEGRO… https://blogs.nvidia.com/blog/krafton-nc-t1-korea-gaming-pc-bang-rtx-spark ...

June 8, 2026 · Liam DING

AI HOT 日报 · 2026-06-07

AI HOT 日报 · 2026-06-07 产品发布/更新 GitHub 开源 Spec Kit 工具包,用产品规范引导 AI 编码 — X:Rohan Paul (@rohanpaul_ai) GitHub 发布开源工具包 Spec Kit,旨在解决 “vibe coding” 的最大弱点——AI 常在规则未明确时就开始编码。它把流程从 “让 AI 直接构建” 改为 “先写产品规范,再让 AI 根据规范实现”。当前 AI 编码模式常因松散提示直接跳入代码,导致需求薄弱、边界遗漏和反复返工。Spec Kit 推动反向流程:先定义产品功能,再澄清差距、制订技术计划、分解任务,最后让 agent 执行。规范成为可执行的开发合约,支持 Copilot、Claude Code、Codex、Gemini、Cursor、Qwen 等 30+ agent 集成。项目已获 109K+ 星标。 https://x.com/rohanpaul_ai/status/2063246343842501091 OpenCV 5 发布:升级全新 DNN 引擎、原生支持大模型 — IT之家(RSS) OpenCV 5 正式发布,采用基于图的 DNN 引擎,ONNX 算子覆盖率从 4.x 的不到 23% 提升至超 80%,原生支持 Transformer、视觉语言模型(VLM)和大语言模型(LLM)。其他更新包括:更好的 Python 集成与命名参数、更紧凑核心代码、清晰硬件加速层、原生 FP16/BF16、规范化 0D/1D 张量、扩展 3D 视觉及现代化文档。该库 GitHub 拥有超 86,000 stars,每日安装量超一百万次。 https://www.ithome.com/0/960/969.htm ...

June 7, 2026 · Liam DING

AI HOT 日报 · 2026-06-06

AI HOT 日报 · 2026-06-06 模型发布/更新 Riverflow 2.5:可控制评分标准的图像模型 — X:OpenRouter (@OpenRouter) 在OpenRouter上线:来自@Sourceful的Riverflow 2.5。 首个具有独立评分标准的图像模型,你可控制该标准以引导其思维和编辑,并具备可控的推理努力,可在速度与质量之间进行权衡。 免费至6月9日(周二)。Fast和Pro见下方🧵。 https://x.com/OpenRouter/status/2062944965978992935 产品发布/更新 Gemini Live 支持实时创建编辑图像 — X:Gemini (@GeminiApp) 你现可直接在 Gemini Live 中创建和编辑图像。 无论是测试房间装饰、解决数学问题,还是制作可分享的梗图,所有操作都实时完成。 只需打开 Gemini 应用,点击 Live 按钮,共享摄像头,告诉 Gemini 你想看到的。 https://x.com/GeminiApp/status/2062936486509785385 智能体协作应如同事般对话和手势 — X:Michael Truell (@mntruell) 与 AI 智能体协作应感觉像与同事协作一样。你应能“与它们交谈”——不仅通过文本聊天,还能一起对着屏幕做手势、实时对话等。 https://x.com/mntruell/status/2062955210897801520 Google AI 本周产品更新:Nano Banana 2、Co-Scientist、dreambeans、Gemma 4 等 — X:Google AI (@GoogleAI) Google AI 本周发布多项更新:Nano Banana 2 及 Pro 正式 GA,可通过 Gemini Enterprise Agent Platform、Gemini API 和 Google AI Studio 获取;Co-Scientist 多智能体系统面向科研自动生成优化新假设;Google Labs 推出 dreambeans,根据用户 Google 应用数据每日生成个性化话题集;Gemma 4 12B 统一无编码器多模态模型可完全离线运行于笔记本;Gemma 4 系列及草稿模型引入 QAT 降低内存需求;Google Magenta RealTime 2 开源实时音乐模型,支持 MIDI 键盘、文本提示和手势演奏… https://x.com/GoogleAI/status/2062942864288387430 ...

June 6, 2026 · Liam DING