📌 本期说明:follow-builders 的 X(推文)/ Podcast 抓取源本期不可用,日报以公开可验证来源(GitHub Trending daily、HuggingFace Daily Papers)为主线 remix。featured 链接已逐条抽查 HTTP 200。

🔥 今日高光

  1. Qwen 把「语言世界模型」装进 agent 大脑——Qwen-AgentWorld 登顶今日 HF 日报(72 赞) 今天学术圈最值得 builder 记一笔的,是阿里 Qwen 团队的 Qwen-AgentWorld: Language World Models for General Agents。它的核心命题简单但分量很重:world model(世界模型)——根据当前观测与动作预测环境如何变化——应该成为通用 agent 的核心认知机制,用来支撑推理与规划。换句话说,让 agent 在真正动手之前,先在「脑内」用语言模型把环境跑一遍、预演后果。把这条放进今天整张 HF 日报来看,信号非常一致:2026 年中,agent 研究的重心正在从「会调工具」上移到「会预测世界、会规划」。对做 agent 产品的人,这意味着「规划层 / 世界建模层」会成为下一个差异化战场。 🔗 https://huggingface.co/papers/2606.24597

  2. 「写 HTML 出视频」继续屠榜——OpenMontage 单日 +3,703 ⭐,全榜增速第一 GitHub Trending 今天增速最猛的项目依旧来自 agentic 视频生产赛道:OpenMontage(⭐18,396,今日 +3,703,全榜第一)自称 “World’s first open-source, agentic video production system”,主打 12 条 pipeline、52 个工具、500+ agent skills,口号是「把你的 AI 编码助手变成一整个视频制作工作室」。这条和上周就在冲榜的 hyperframes(Write HTML, Render video)是同一股浪:视频生产正在从「时间轴 GUI 拖拽」迁移到「agent 写结构化标记 → 渲染管线出片」。做内容 / 营销 / 教育类 AI 产品的 builder,这是一个值得立刻试水的范式。 🔗 https://github.com/calesthio/OpenMontage

  3. agent 的护城河变成「skills × 团队 × 设计规范」——harness / design.md / orca 同日冲榜 今天 Trending 上有三个项目把「agent 工程化」讲得格外清楚:

    • revfactory/harness(⭐7,632,今日 +274)——一个 meta-skill,专门用来「设计领域专属的 agent 团队、定义专家 agent、并自动生成它们要用的 skills」。这正是「agent = 一支虚拟团队」思路的工具化落地。
    • google-labs-code/design.md(⭐16,974,今日 +504)——Google Labs 提出的 DESIGN.md 规范:给 coding agent 一份「持久、结构化的设计系统理解」,让 agent 在改 UI 时不再失忆。和上周 Garry Tan 的 gstack(沉淀 .claude 工作流)一脉相承。
    • stablyai/orca(⭐6,590,今日 +265)——面向「一队并行 agent」的 ADE(Agent Development Environment),可用自己的订阅跑任意 coding agent,桌面 + 移动端都能用。 三者合起来是一句话:agent 的竞争已从「模型多强」转向「你给 agent 配齐了多少 skills、团队结构、并行编排与设计规范」。 🔗 harness: https://github.com/revfactory/harness 🔗 design.md: https://github.com/google-labs-code/design.md 🔗 orca: https://github.com/stablyai/orca

📄 论文速递(HuggingFace Daily Papers · 2026-06-24)

今日 HF 日报主题高度集中在 Agentic AI:世界模型、GUI agent 长程化、OS 级 agent harness、agent 训练数据配方。这是一个很强的研究风向标。

  • Qwen-AgentWorld: Language World Models for General Agents(72 赞) Qwen 团队主张把「世界模型(预测环境动态)」作为通用 agent 的核心认知机制,用语言模型在动作前预演环境演化,从而强化推理与规划能力。 🔗 https://huggingface.co/papers/2606.24597

  • MemGUI-Agent: An End-to-End Long-Horizon Mobile GUI Agent with Proactive Context Management(31 赞) 指出现有移动 GUI agent 在「长程任务」上不可靠,根因是 ReAct 式 prompting 被动堆叠每步信息。MemGUI-Agent 用主动式上下文管理在多步、多 App 跳转中保留关键中间事实。对做手机端自动化 / RPA agent 的人很有参考价值。 🔗 https://huggingface.co/papers/2606.19926

  • MobileForge: Annotation-Free Adaptation for Mobile GUI Agents(32 赞) 针对「移动 App 数量多、更新频繁、难以用人写任务覆盖」的痛点,提出免标注的分层反馈引导策略优化,让 GUI agent 低成本适配真实目标 App。 🔗 https://huggingface.co/papers/2606.19930

  • AOHP: An Open-Source OS-Level Agent Harness for Personalized, Efficient and Secure Interaction(25 赞) 直指当下操作系统是「以应用为中心」设计、对 agent 不友好。AOHP 提出一个开源的 OS 级 agent harness,让 agent 在跨应用、跨数据源调工具、管记忆、完成任务时更个性化、高效且安全。 🔗 https://huggingface.co/papers/2606.23449

  • OpenThoughts-Agent: Data Recipes for Agentic Models(13 赞) 公开探讨「如何为广泛能力的 agent 模型筛选训练数据」。现有开源努力(SWE-Smith、SERA、Nemotron-Terminal)多只针对单一 benchmark,本文给出更通用的agent 数据配方。对自训 agent 模型的团队是稀缺的公开参考。 🔗 https://huggingface.co/papers/2606.24855

  • Escaping the Self-Confirmation Trap: An Execute-Distill-Verify Paradigm for Agentic Experience Learning(8 赞) 指出 agent「经验自进化」普遍困在单 agent 自我确认陷阱——同一个 agent 既执行、又总结、又决定记什么,容易自我强化错误。提出 Execute–Distill–Verify 三段式范式做经验学习。和昨天 GateMem「记忆治理」的思路遥相呼应。 🔗 https://huggingface.co/papers/2606.24428


🛠️ 新工具 / 项目(GitHub Trending · daily)

  • OpenMontage — ⭐18,396(今日 +3,703,全榜增速第一)· Python 开源 agentic 视频生产系统,12 pipeline / 52 工具 / 500+ agent skills,把编码助手变成视频工作室。 🔗 https://github.com/calesthio/OpenMontage

  • revfactory/harness — ⭐7,632(今日 +274)· HTML meta-skill:设计领域专属 agent 团队、定义专家 agent,并自动生成它们的 skills。 🔗 https://github.com/revfactory/harness

  • google-labs-code/design.md — ⭐16,974(今日 +504)· TypeScript DESIGN.md 规范:给 coding agent 一份持久、结构化的设计系统理解,让 agent 改 UI 不失忆。 🔗 https://github.com/google-labs-code/design.md

  • stablyai/orca — ⭐6,590(今日 +265)· TypeScript 面向一队并行 agent 的 ADE,可用自有订阅跑任意 coding agent,桌面 + 移动端。 🔗 https://github.com/stablyai/orca

  • JCodesMore/ai-website-cloner-template — ⭐19,086(今日 +693)· TypeScript 一条命令 + AI 编码 agent,克隆任意网站的模板项目。 🔗 https://github.com/JCodesMore/ai-website-cloner-template

  • NousResearch/hermes-agent — ⭐201,769(今日 +1,174)· Python Nous Research 的开源 agent,口号「与你共同成长的 agent」。 🔗 https://github.com/NousResearch/hermes-agent

  • apple/container — ⭐41,716(今日 +1,746)· Swift Apple 官方:用轻量虚拟机在 Mac(Apple silicon 优化)上创建并运行 Linux 容器。 🔗 https://github.com/apple/container


🇨🇳 中文圈

  • ZhuLinsen/daily_stock_analysis — ⭐48,210(今日 +1,461,国内项目冲榜)· Python LLM 驱动的多市场股票智能分析系统:多源行情、实时新闻、决策看板与自动推送,支持零成本定时运行。是今天 Trending 上少见的「中文 + 实用 + 高增速」项目,思路(多源数据 → LLM 决策看板 → 自动推送)对做行业情报类 agent 很有借鉴意义。 🔗 https://github.com/ZhuLinsen/daily_stock_analysis

  • Qwen-AgentWorld(阿里 Qwen 团队) — 见今日高光① 国产团队在「agent 世界模型」这一前沿方向拿下今日 HF 日报榜首,是中文圈值得记一笔的学术信号。 🔗 https://huggingface.co/papers/2606.24597

  • LingxiDiagBench(19 赞)— 面向中文精神科问诊与诊断的多 agent benchmark 针对精神科医生短缺、问诊主观性强的现实问题,构建多 agent 框架来评测 LLM 在中文心理 / 精神诊断中的表现。是「AI + 中文医疗」垂直方向的可验证基准。 🔗 https://huggingface.co/papers/2602.09379


📊 今日一句话总结

agent 正在同时长出两样东西:往「脑内」长出世界模型(先预演再行动),往「身体」长出操作系统 / harness / 技能库 / 团队(OS 级承载、并行编排、可复用 skills)。模型本身不再是护城河,「给 agent 配齐什么」 才是。


本期来源:GitHub Trending(daily)+ HuggingFace Daily Papers(2026-06-24)。follow-builders X / Podcast 源本期不可用。featured 链接已抽查 HTTP 200。