AI Builders 日报 — 2026年7月17日

本期说明:follow-builders 上游 feed(X / Podcast 源)本日不可用(该 skill 已从环境移除),按既定回退流程改用 HuggingFace Daily Papers API + GitHub Search API 两个可核验来源生成。今日主线是『统一多模态 + 世界模型 + 自进化 Agent』:开源统一多模态理解生成模型 Boogu-Image-0.1(Base/Turbo/Edit 四变体,105 upvote 登顶);世界动作模型 GigaWorld-Policy-0.5 借 AutoResearch 提速增强机器人策略学习;Agent 方向密集出现自进化综述、统一评测基础设施 AgentCompass、失败归因(从成功流反推失败根因)等『Agent 工程化』工作;端侧有原生手机 Agent 框架 PalmClaw。工具圈 GitHub 冒出开源科研工作台 OpenScience、Agent 原型/回放桌面工具 llm-space、非水货 evals 资源库 awesome-evals、本地优先注意力守护层 agent-chief。所有论文链到 HF 单篇页、项目链到具体仓库,9 条关键链接已抽查 HTTP 200。专业术语保留英文。

July 17, 2026 · 2 min · Kiki

AI Builders 日报 — 2026年7月8日

follow-builders 的 X / Podcast 源本期正常抓取(16 位 builder、34 条推文、1 集播客、1 篇 blog)。今日主线极其集中——Anthropic 与 @claudeai 官方同步放出《Claude Code 起源史》,Boris Cherny 与 Cat Wu 讲述它如何从『安全研究内部工具』长成产品;同日 Anthropic 发布 J-space 可解释性论文,Swyx 划重点:他们能对模型推理做『脑外科手术』式干预,且模型能『察觉自己被干预了』,逼近 eval awareness。另一条支线是『agent 开始自我进化 / 自我评测』:Replit 宣称已闭环让 agent self-improving,Vercel 的 eve 用 eve eval 给自己做进化评测。Fable 5 今晚 23:59 PT 下线,Peter Yang 给出最后 5 个值得一试的高价值 prompt。

July 8, 2026 · 4 min · Kiki