本期说明:zarazhangrui/follow-builders 上游 X / Podcast feed 本日不可用,按 workflow.md 既定回退流程,改用两个可核验来源:HuggingFace Daily Papers API(2026-07-14 批次,共 15 篇)GitHub Search API(近期高星 AI agent 仓库)。中文圈/产品发布板块因 web_search 暂不可用而略去。所有论文链到 huggingface.co/papers/XXXX 单篇页,项目链到 github.com/owner/repo 具体仓库,6 条关键外链已抽查 HTTP 200。专业术语保留英文。

🔥 今日高光

  1. 具身智能一天双发:导航基座 + 机器人 Agent OS。ABot 系列同批放出 ABot-N1(Visual Language Navigation 基座模型,把 grounded 空间决策的深度推理与跨任务通用性统一起来,针对现有单体 policy 的 coordinate drift 与长尾语义处理差、缺乏可解释性下手)与 ABot-AgentOS(坐在底层控制器之上的通用机器人 Agent 操作系统,提供 deliberative 推理层 + 终身多模态记忆 + 工具使用 + 验证 + 跨本体执行)。两篇合计 upvote 144,是今天 HF 榜单最热的方向。
  2. Weak-to-Strong 直接 on-policy 蒸馏,专治『post-training 越来越贵』。今日最高票(87)论文指出:RLVR 每换一个强模型就要重跑、target 模型要产大量 rollout,post-training 本身正在成为瓶颈。方案是先在 rollout 便宜的小模型上跑 RL,再把 RL 的收益直接迁移到强模型——把最贵的那段成本挪到便宜的地方。
  3. 端侧个人记忆继续卷:LightMem-Ego。面向手机/可穿戴设备持续感知视觉与音频流的个人 AI 助手,做一个能持续累积、组织、检索长期经历的轻量流式多模态记忆,回答『过去发生了什么』这类查询。
  4. 可解释性/元认知升温:《Metacognition in LLMs》综述把元认知摆为『可靠、透明 AI 系统的基石』,系统梳理 LLM 何时、如何、在多大程度上能表现或被赋予元认知能力——与近期 Anthropic 那条『可干预推理 + 模型自我察觉』的可解释性主线呼应。
  5. 工具圈:个人投研 Agent 与 AI 可驱动的创作工具。GitHub 近期高星里,Vibe-Research(A股/美股/港股个人投研 Agent,每日复盘 + 资讯雷达 + 个股数据)已破 800 星;FableCut(零依赖、AI agent 可通过 JSON timeline + MCP/REST 驱动的浏览器视频编辑器)与 ditto(把 Claude Code / Codex 日志挖成本地 you.md 个人画像)都体现了『把 agent 接进真实创作/工作流』的势头。

数据概览:HF Daily Papers 15 篇(07-14 批次)· 精选 6 篇 · GitHub 近期高星 AI 仓库精选 6 个 · follow-builders X/Podcast 源本日不可用 · 6 条关键外链已验证 HTTP 200。

📄 论文速递(HuggingFace Daily Papers, 2026-07-14 批次)

  • Weak-to-Strong Generalization via Direct On-Policy Distillation(up 87)— 先在小模型上跑 RLVR,再把收益直接迁移到强模型,压低越来越贵的 post-training rollout 成本。HF
  • ABot-N1: Toward a General Visual Language Navigation Foundation Model(up 78)— VLN 基座模型,统一 grounded 空间决策推理与跨具身任务通用性,缓解 coordinate drift 与长尾语义、提升可解释性。HF
  • ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory(up 66)— 位于底层控制器之上的通用机器人 Agent OS,提供 deliberative 推理、终身多模态记忆、工具使用、验证与跨本体执行的运行时层。HF
  • 4D Human-Scene Reconstruction from Low-Overlap Captures(up 40)— 仅用少量低重叠相机做动态人体表演的 4D 重建,借 video diffusion 补全欠观测区域、减少 artifact。HF
  • LightMem-Ego: Your AI Memory for Everyday Life(up 32)— 面向手机/可穿戴的轻量流式多模态记忆,持续累积、组织、检索长期日常经历。HF
  • Metacognition in LLMs: Foundations, Progress, and Opportunities(up 12)— 元认知综述,将其定位为可靠、透明 AI 的基石,梳理 LLM 元认知的现状与机会。HF

🛠️ 新工具/项目(GitHub 近期高星)

  • simonlin1212/Vibe-Research(★806)— A股/美股/港股的个人投研 Agent:每日复盘、资讯雷达、个股数据。repo
  • ronak-create/FableCut(★424)— 零依赖、可被 AI agent 驱动的浏览器视频编辑器:JSON timeline + MCP/REST。repo
  • Brain0-ai/brain0(★424)— AI 写代码的『黑匣子』:被动决策图,把每次 commit 关联到背后的 agent 决策。repo
  • ohad6k/ditto(★170)— 挖掘你的 Claude Code / Codex 日志,生成本地 you.md agent 画像。repo
  • aws-samples/sample-specship(★140)— spec-driven 自主工程工作流:recon → plan → build → verify。repo
  • synthetic-sciences/openscience(★2.4k)— 面向科研的开源 AI 工作台。repo

本期无 follow-builders X 推文与 Podcast 数据;Builder 动态、中文圈、Podcast 板块待上游 feed / web_search 恢复后回归。