AI Builders Digest · 2026-08-22
X / Twitter
Swyx(AI builder,Latent Space / smol.ai 发起人)
Swyx 罕见地认真表态:别把 “Simulation is a new scaling law”(模拟是新的 scaling law)当成营销话术。他自认迟了两年才看懂 Karpathy、李飞飞为什么押注 Joon Sung Park 和 Simile——当年 Smallville 毫无商业应用,但如果认真对待 RSI(递归自我改进),当模型能自动化越来越大部分的 ML 研究与 AI 工程后,最后一道屏障就是"模拟人类与人类反馈",而 Simile 正是做这件事的团队,且已在 Fortune 100 找到 PMF。另外,他的 “Kill My SaaS” 系列宣布要杀第二个 SaaS。
https://x.com/swyx/status/2090948945753076141 https://x.com/swyx/status/2090908959590740033
Thibault Sottiaux(OpenAI,Codex & ChatGPT)
Codex 的 “banked reset”(额度累积重置)正式上线,ChatGPT Work 和 Codex 所有付费用户可用。他也坦白:本周部分用户缓存命中率比前几周差,可能解释了为什么额度消耗更快,团队正在调查,明天给出更新。
https://x.com/thsottiaux/status/2090964822422949999 https://x.com/thsottiaux/status/2091033630147854385
Peter Yang(AI 教程创作者)
对 AI 助手 Instinct 的评测:上手流程(连接 iMessages、Google Workspace、MCP)极其顺滑,也比其他助手更主动,但两个问题让他无法推荐——一是 Instinct 未经许可索引并保留邮件、且不允许删除;二是所有对话挤在单一线程里,做不了正经工作。他最终选择继续用 ChatGPT Work 和 Codex。
https://x.com/petergyang/status/2090936583814025417 https://x.com/petergyang/status/2090814910720835633
Madhu Guru(Meta AI 高级总监,前 Google Gemini/Veo 负责人)
反共识观点:别再把你精心设计的 eval 套件压成一个分数——“这是平均值的暴政”。AI 系统的质量没有单一维度:模型可能在简单摘要上 85%→89%、事实问答 80%→85%,却在复杂金融分析上 70%→63%,一个总分把这些全藏住了。加权分数同样是"给主观判断披上虚假的数学外衣"。他透露这是 Gemini 早期踩过的坑。
https://x.com/realmadhuguru/status/2090930137885774324
Thariq(Anthropic,Claude Code)
Anthropic 内部最近高频使用的 ELI5 skill 公开了:输入 /eli5 <任何问题>,Claude 会用"像对一无所知的人解释"的方式,输出大图少字的 HTML artifact。他常用它解释模块工作原理、复盘线上事故。目前是社区插件,官方在考虑转正,可自行安装体验。
https://x.com/trq212/status/2090884854590382515 https://x.com/trq212/status/2090890394880155888
Guillermo Rauch(Vercel CEO)
v0 现在支持连接 Grok 和 Codex 订阅,沙盒里即可试用。他还透露团队把 is-agentic 评测放进循环里反复跑,直到拿到 100/100——这个过程逼他们补上了不少差距。
https://x.com/rauchg/status/2090953806624489501 https://x.com/rauchg/status/2090858571613470919
Aaron Levie(Box CEO)
大胆判断:当前 AI 的进步速度是科技史上任何时期都无法比拟的——同任务成本持续下降、能力更通用、更快、渗透更深。当智能变得"便宜到无法计量",最大的机会就是把 AI 扩散进整个经济。对应用层 AI 公司来说这是最好的时代,创新与竞争都是顺风,现在是 startups 的巨大时刻。
https://x.com/levie/status/2091038566260539574
Nikunj Kothari(fpvventures 合伙人)
一个具体到离谱的 builder 日常:女儿上幼儿园,学校菜单挂在一个结构混乱的随机网站上。他用 Claude Code 抓网络请求找到未鉴权的 API,摸清格式后接进自家的 Hermes bot——现在每天早上 Home bot 自动播报当天早午餐,方便给孩子备餐。
https://x.com/nikunj/status/2090884422178627624
Claude(Anthropic 官方)
Claude Security 推出 Mythos 漏洞扫描:把 GitHub repo 指给 Claude,Mythos 会跨文件追踪数据流、推理组件间如何交互,每个发现附带 CWE 分类、置信度、严重度和建议修复;建议补丁可直接在 Claude Code on the web 打开,扫描按标准 token 用量计费。配套动作包括与安全厂商集成 Mythos 5、Defender Advantage Fund 提供 3500 万美元积分支持开源安全、数周内扩大 Cyber Verification Program。
https://x.com/claudeai/status/2090852316328902930 https://x.com/claudeai/status/2090852320128938319
Podcast
No Priors:What Chess.com Teaches US About Superhuman Capabilities(Chess.com CEO Erik Allebest)
The Takeaway:机器碾压人类 30 年,国际象棋反而迎来史上最高热度——AI 没有杀死人类游戏,而是让它更繁荣。
Chess.com CEO Erik Allebest:2005 年从破产拍卖花 5.6 万美元买下 chess.com 域名,VC 都说"不可投资";他没融资,如今 2.5 亿注册用户。
他最反直觉的观点是:「从根本上说,人类想做人类的事——人类与人类竞争,人类创造东西,人类解决问题。」深蓝击败卡斯帕罗夫后有人预言棋已死,事实正相反:Stockfish 一度让棋变无聊,神经网络引擎 Leela Chess Zero 又让它重新激动人心;AI 最终成了陪练与教练,让人更享受棋。他还把"评分文化"搬进新业务 Gambit——“rating 掉 100 分比输掉 100 美元更让我难受。”
对创始人他同样反主流:“今天的诅咒是创始人建议太多”——雇圣何塞州立的朋友、远程、不融资、不买量、选个小市场,然后"别再听别人告诉你该做什么,去做就是了"。