Agent 工程化正在从“会调用工具”转向“有运行时、技能、记忆和沙箱”。 Vercel Eve、BuilderIO Skills、COMPASS、agent-apprenticeship 同时爆发,说明市场关注点已从单个提示词迁移到可复用 agent 操作系统。
今日重点项目雷达
Forsy-AI/agent-apprenticeship
是什么:面向真实工作循环的 agent 学徒生态,强调 agent traces、训练信号交换、Claude Code/Codex/Cursor/OpenClaw 等多工具协作。;判断标签:新变量
Source ↗XiaomiMiMo/MiMo-Code
是什么:小米开源的 coding agent / model-agent co-evolution 项目,10 天内破万星。;判断标签:趋势增强
Source ↗vercel/eve
是什么:Vercel 的 agent framework,围绕 markdown、skills、sandbox、workflow 组织 agent。;判断标签:趋势增强
Source ↗dongshuyan/compass-skills
是什么:中文个性化 AI 任务总控 Skills 系统,覆盖 agent memory、task management、Codex/Claude skills。;判断标签:新变量
Source ↗op7418/guizang-social-card-skill
是什么:面向小红书图文和公众号封面的 Claude Code / Codex skill,输出 HTML 到 PNG。;判断标签:趋势增强
Source ↗数据来源:AI HOT + GitHub 近期爆发项目 + BestBlogs 今日精选 + Follow Builders 建造者 feed + 必要核实。筛选标准:实时性、增速、AI/Agent 相关度、对 ABU9/OpenClaw 的启发。
降级说明:BestBlogs 今日接口返回
success=true但data=null,本期“值得读 / 值得看”改用 AI HOT daily 与 Follow Builders;GitHub、AI HOT、Follow Builders 采集正常;质量门、HTML 发布、Wiki 入库状态见最终执行结果。
一、今日主线判断
Agent 工程化正在从“会调用工具”转向“有运行时、技能、记忆和沙箱”。 Vercel Eve、BuilderIO Skills、COMPASS、agent-apprenticeship 同时爆发,说明市场关注点已从单个提示词迁移到可复用 agent 操作系统。
“代码作为动作接口”成为空间推理、部署、研究自动化的共同语言。 NVIDIA SpatialClaw、Cloudflare temporary deploy、AutoResearch 都在证明:模型能力之外,关键是把外部世界包装成可验证、可回滚的代码动作。
企业 AI 的下一层竞争会落到记忆、网关和可观测成本。 Elasticsearch agent memory、OpenRouter vs LiteLLM 的讨论指向同一个问题:企业不是缺模型,而是缺可控的上下文、路由、评估和费用边界。
Skills 生态继续升温,但 star 异常和营销型仓库也明显增多。 今天 GitHub 热点中有大量“skill / Codex / Claude Code”项目,必须用真实 README、更新节奏、可运行性和重复出现次数做降噪。
对 ABU9 的信号很直接:汽车数字化 AI 不该只做问答助手,而要做行业 Skill 包 + 交付审计 + 售前资产生成链路。 这条路径比单点 Copilot 更接近可复制产品。
二、GitHub 近期爆发项目
Forsy-AI/agent-apprenticeship
- 是什么:面向真实工作循环的 agent 学徒生态,强调 agent traces、训练信号交换、Claude Code/Codex/Cursor/OpenClaw 等多工具协作。
- 元数据:创建 2026-06-19;stars 502;最近更新 2026-06-20;采集窗口/来源查询
github.ranked_recent/new_7d_100。 - 判断标签:新变量
- 意味着什么:它把“agent 用过就结束”的过程变成可积累训练信号,这正是 OpenClaw 长期记忆、任务复盘、skill 演化需要补的层。
- 链接:https://github.com/Forsy-AI/agent-apprenticeship
XiaomiMiMo/MiMo-Code
- 是什么:小米开源的 coding agent / model-agent co-evolution 项目,10 天内破万星。
- 元数据:创建 2026-06-10;stars 10069;最近更新 2026-06-19;采集窗口/来源查询
github.ranked_recent/new_14d_200_ai_agent,new_30d_500_ai_agent。 - 判断标签:趋势增强
- 意味着什么:国内大厂开始把 coding agent 作为模型能力展示窗口,不只是 IDE 插件;ABU9 可关注其任务编排、评测和中文工程场景适配。
- 链接:https://github.com/XiaomiMiMo/MiMo-Code
vercel/eve
- 是什么:Vercel 的 agent framework,围绕 markdown、skills、sandbox、workflow 组织 agent。
- 元数据:创建 2026-06-16;stars 1841;最近更新 2026-06-20;采集窗口/来源查询
github.ranked_recent/new_7d_100,new_14d_200_ai_agent,new_30d_500_ai_agent;过去 7 天出现 3 次。 - 判断标签:趋势增强
- 意味着什么:Vercel 把前端工程优势延伸到 agent framework,说明“web 原生 agent 运行时”会成为新入口;但重复出现较多,本期保留是因为仍在活跃更新。
- 链接:https://github.com/vercel/eve
dongshuyan/compass-skills
- 是什么:中文个性化 AI 任务总控 Skills 系统,覆盖 agent memory、task management、Codex/Claude skills。
- 元数据:创建 2026-06-15;stars 397;最近更新 2026-06-20;采集窗口/来源查询
github.ranked_recent/new_7d_100。 - 判断标签:新变量
- 意味着什么:中文社区正在把 skills 从“提示词文件”升级为个人/组织工作流入口;OpenClaw 可以借鉴其任务总控与本地优先设计。
- 链接:https://github.com/dongshuyan/compass-skills
BuilderIO/skills
- 是什么:Builder.io 发布的 coding agents skills 集合,强调将可复用能力打包给 agent。
- 元数据:创建 2026-06-10;stars 2212;最近更新 2026-06-17;采集窗口/来源查询
github.ranked_recent/new_14d_200_ai_agent,new_30d_500_ai_agent;过去 7 天出现 3 次。 - 判断标签:趋势增强
- 意味着什么:设计、前端、内容生产类 skill 正在标准化;ABU9 的售前方案、交付验收、车型素材生成可以做成行业 skill 包。
- 链接:https://github.com/BuilderIO/skills
KunAgent/Kun
- 是什么:可嵌入业务应用的 AI agent workspace,提供 Code / Write 双模式。
- 元数据:创建 2026-05-21;stars 4602;最近更新 2026-06-20;采集窗口/来源查询
github.ranked_recent/new_30d_500_ai_agent。 - 判断标签:趋势增强
- 意味着什么:agent 不只在开发者 CLI 里,也会嵌入业务系统成为“工作区组件”;这对企业软件厂商比纯聊天助手更有价值。
- 链接:https://github.com/KunAgent/Kun
safishamsi/graphify
- 是什么:把代码、SQL schema、脚本、文档、论文、图片、视频转成可查询知识图谱的 agent skill。
- 元数据:创建 2026-04-03;stars 69861;最近更新 2026-06-19;采集窗口/来源查询
github.ranked_recent/fresh_90d_active_ai_agent。 - 判断标签:趋势增强
- 意味着什么:代码库和交付资料的知识图谱化,是企业 agent “看懂项目现场”的关键能力;ABU9 可用于老项目接手、交付审计、客户知识库构建。
- 链接:https://github.com/safishamsi/graphify
diffusionstudio/lottie
- 是什么:用 Claude Code 或 Codex 生成生产可用 Lottie 动画的工具。
- 元数据:创建 2026-06-04;stars 3509;最近更新 2026-06-15;采集窗口/来源查询
github.ranked_recent/new_30d_500_ai_agent。 - 判断标签:新变量
- 意味着什么:agent 生成物正在从代码和文本扩展到可交付视觉资产;可用于 ABU9 售前 demo、车企活动页、数字展厅动效模板。
- 链接:https://github.com/diffusionstudio/lottie
GordenSun/GordenSuperPPTSkills
- 是什么:面向 AI PPT 生成的 skill,走图片格式 PPT 再转可编辑 PPTX 的路线。
- 元数据:创建 2026-06-07;stars 1094;最近更新 2026-06-07;采集窗口/来源查询
github.ranked_recent/new_14d_200_ai_agent,new_30d_500_ai_agent。 - 判断标签:待验证
- 意味着什么:PPT/方案类 artifact 是企业 AI 的高频刚需,但要验证输出质量、版权素材和可编辑性;适合作为 ABU9 售前方案链路的参考。
- 链接:https://github.com/GordenSun/GordenSuperPPTSkills
op7418/guizang-social-card-skill
- 是什么:面向小红书图文和公众号封面的 Claude Code / Codex skill,输出 HTML 到 PNG。
- 元数据:创建 2026-05-27;stars 3809;最近更新 2026-05-27;采集窗口/来源查询
github.ranked_recent/new_30d_500_ai_agent。 - 判断标签:趋势增强
- 意味着什么:营销物料生成 skill 化正在成熟;ABU9 可把车型海报、经销商活动图、销售话术卡片做成低成本模板。
- 链接:https://github.com/op7418/guizang-social-card-skill
三、最近 7 天新项目:值得点开
Waishnav/devspace
- 是什么:号称把 ChatGPT 变成 Codex 的项目。
- 元数据:创建 2026-06-14;stars 1607;最近更新 2026-06-17;采集窗口/来源查询
github.ranked_recent/new_7d_100,new_14d_200_ai_agent,new_30d_500_ai_agent。 - 判断标签:待验证
- 意味着什么:需求真实存在:用户希望把聊天产品升级为可执行工作区;但描述过短,需要验证可用性和安全边界。
- 链接:https://github.com/Waishnav/devspace
nnecrkvenuOX/formcms
- 是什么:ASP.NET Core + React 的开源 headless CMS,描述中强调 AI Agent、REST/GraphQL 和 GrapesJS 页面设计器。
- 元数据:创建 2026-06-17;stars 332;最近更新 2026-06-17;采集窗口/来源查询
github.ranked_recent/new_7d_100。 - 判断标签:待验证
- 意味着什么:如果项目真实,说明 .NET 企业软件也在快速贴合 agent 叙事;适合 ABU9 技术栈观察,但作者名和描述需要进一步核验。
- 链接:https://github.com/nnecrkvenuOX/formcms
ngrok/webernetes
- 是什么:在浏览器里运行 Kubernetes 的实验项目。
- 元数据:创建 2026-06-16;stars 318;最近更新 2026-06-18;采集窗口/来源查询
github.ranked_recent/new_7d_100。 - 判断标签:新变量
- 意味着什么:浏览器沙箱/本地实验环境会降低 agent 操作基础设施的门槛;OpenClaw 可关注“可视化、可回滚、可隔离”的运行环境。
- 链接:https://github.com/ngrok/webernetes
baskduf/FableCodex
- 是什么:Codex-style coding agent workflow,强调像 Fable 一样规划。
- 元数据:创建 2026-06-14;stars 324;最近更新 2026-06-18;采集窗口/来源查询
github.ranked_recent/new_7d_100。 - 判断标签:新变量
- 意味着什么:coding agent 的差异化正在从模型转向 planning workflow;可作为 OpenClaw 子任务规划和复盘格式的参考。
- 链接:https://github.com/baskduf/FableCodex
majidmanzarpour/threejs-game-skills
- 是什么:用于构建 Three.js 浏览器游戏的 agent skills,覆盖玩法、3D、UI、QA 和可选 AI 资产。
- 元数据:创建 2026-06-14;stars 378;最近更新 2026-06-16;采集窗口/来源查询
github.ranked_recent/new_7d_100。 - 判断标签:新变量
- 意味着什么:垂直领域 skill 会从办公扩展到游戏、视频、3D;对 ABU9 的启发是“汽车展厅 3D 互动 demo”也可以被 skill 化。
- 链接:https://github.com/majidmanzarpour/threejs-game-skills
dzcmemory-web/bazi-ziwei-skill
- 是什么:AI 八字 + 紫微斗数排盘与 HTML 命盘海报 skill。
- 元数据:创建 2026-06-13;stars 444;最近更新 2026-06-14;采集窗口/来源查询
github.ranked_recent/new_7d_100。 - 判断标签:噪音降权
- 意味着什么:它证明“任何可重复内容生成流程都能 skill 化”,但与企业 AI 和汽车数字化弱相关,本期只作为 skill 泛化信号,不进入重点跟踪。
- 链接:https://github.com/dzcmemory-web/bazi-ziwei-skill
四、AI 热点新闻
Cloudflare 为 AI 智能体推出 Temporary Accounts
- 事件:Cloudflare Workers 支持
wrangler deploy --temporary,让 agent 无需完整人工开户注册也能临时部署 Worker。 - 可信度:一手发布
- 意味着什么:agent 的“最后一公里部署”正在被基础设施厂商直接适配;OpenClaw 应把临时环境、权限边界、过期回收做成默认能力。
- 链接:https://developers.cloudflare.com/workers/
Claude Code v2.1.183 强化自动模式安全
- 事件:AI HOT 摘要显示 Claude Code 阻止未经请求的
git reset --hard、git commit --amend、terraform destroy等破坏性命令,并修复多项 TUI/MCP/子 agent 问题。 - 可信度:一手发布
- 意味着什么:coding agent 的竞争已经进入“安全默认值”阶段;OpenClaw 本地自动化也要把危险命令、外发消息、配置变更作为高等级审批。
- 链接:https://docs.anthropic.com/en/docs/claude-code
NVIDIA Research 发布 SpatialClaw
- 事件:SpatialClaw 把代码作为动作接口,组合 Depth Anything、SAM 等感知工具做 3D 空间推理;AI HOT 引用的 benchmark 数字需待第三方验证。
- 可信度:媒体报道
- 意味着什么:空间推理不是只靠 VLM 参数堆出来,而是让 agent 调工具、写代码、验证中间结果;这对智能展厅、车间视觉巡检有启发。
- 链接:https://www.marktechpost.com/2026/06/19/nvidia-ai-introduce-spatialclaw-a-training-free-agent-that-treats-code-as-the-action-interface-for-spatial-reasoning
DeepSeek 研究员开源 AutoResearch
- 事件:Deli Chen 将 AutoResearch 协议开源,宣称 agent 自主完成 285B 模型 RL 研究闭环;“全程零人工干预”等能力表述需继续核验。
- 可信度:待核实
- 意味着什么:研究自动化的方向成立,但真正价值不在“零人工”,而在实验设计、GPU 任务、debug、结论复盘的可审计链路。
- 链接:https://github.com/search?q=AutoResearch+DeepSeek+Deli+Chen&type=repositories
AlphaFold 负责人 John Jumper 将加入 Anthropic
- 事件:AI HOT 摘要显示 John Jumper 离开 Google DeepMind,计划加入 Anthropic。
- 可信度:媒体报道
- 意味着什么:Anthropic 继续吸收科学 AI 顶尖人才,可能加强模型在科学推理、长链路研究、可靠性评估上的能力;对企业侧意味着 Claude 生态仍值得重点跟踪。
- 链接:https://www.anthropic.com/news
微软被曝双向转售 GPT 与 DeepSeek
- 事件:X 消息称彭博社报道微软既向中国企业销售 ChatGPT,也向西方客户提供 DeepSeek 模型。
- 可信度:X 传闻
- 意味着什么:如果属实,模型分发会越来越像云市场和网关生意;但在未回源到 Bloomberg/微软前,不能按正式商业事实使用。
- 链接:https://x.com/AYi_AInotes/status/2068218661710512231
Figure 机器人数被称超过人类员工数
- 事件:Rohan Paul 在 X 上转述 Figure 机器人数超过员工数。
- 可信度:X 传闻
- 意味着什么:这是机器人产业情绪信号,不是运营数据确认;对汽车行业可观察“机器人作为工厂/展厅劳动力”的叙事升温。
- 链接:https://x.com/rohanpaul_ai/status/2068089038213693800
阿里开源向量数据库 Zvec
- 事件:AI HOT 摘要称阿里开源内部向量数据库 Zvec,支持十亿向量毫秒级检索与混合搜索;性能表述需第三方验证。
- 可信度:待核实
- 意味着什么:轻量向量库仍有机会,尤其适合嵌入本地 agent 记忆和小型企业知识库;ABU9 可关注是否适配私有化交付。
- 链接:https://github.com/search?q=zvec+vector+database&type=repositories
JAWBONE Act 聚焦政府与平台内容审查透明度
- 事件:AI HOT 摘要显示美国两党法案拟为广播商、互动计算服务和 AI 提供商建立针对政府施压的诉权与透明体系。
- 可信度:媒体报道
- 意味着什么:AI 平台治理会越来越多进入法律层;企业 AI 出海需要准备内容审计、政府请求记录和用户表达边界。
- 链接:https://www.eff.org/
开源教程《Deep Agents 实战》发布
- 事件:LangChain 中文生态作者发布 Deep Agents 教程,强调 Runtime、Framework、Harness 三层架构、虚拟文件系统、子 agent 委派和 Skills 复用。
- 可信度:X 传闻
- 意味着什么:Deep Agents 的工程共识正在形成:上下文工程 + 文件系统 + 子任务并行 + skills;这与 OpenClaw 的演化方向高度一致。
- 链接:https://x.com/shao__meng/status/2068306942184034471
五、论文 / 研究 / 观点
代码作为空间推理动作接口。 SpatialClaw 的关键不是单个模型更强,而是把感知工具、代码执行和结构化验证连接起来;这可迁移到车间巡检、展厅空间问答、售后图像诊断。
因果大模型成为下一代范式讨论。 黄碧薇教授提出“相关性小模型→因果小模型→相关性大模型→因果大模型”的框架;这对企业 AI 的启发是:只做 RAG 问答不够,未来要能解释“为什么”和“如果改变变量会怎样”。
Agent memory 的工程形态趋于清晰。 Elasticsearch 方案把记忆拆成情景、语义、程序三类,再用 BM25 + 向量 + rerank;对 OpenClaw 来说,记忆不应只有聊天历史,而要有任务痕迹、决策、操作规程和复核条件。
LLM 网关选择正在从功能清单转向经济模型。 OpenRouter vs LiteLLM 的核心不只是托管或自建,而是请求规模、隐私、路由策略、故障转移和成本观测;ABU9 私有化项目应优先保留可替换网关层。
链接:https://github.com/BerriAI/litellm
“数据黑洞”提醒不要高估 RL 自动化。 如果强化学习仍大量依赖验证器和专家示例,企业 AI 的壁垒就不是谁接了最强模型,而是谁拥有可验证业务数据和反馈闭环。
六、今天值得读 / 值得看(BestBlogs / Follow Builders 精选)
标题/核心观点:Deep Agents 实战教程把 Runtime、Framework、Harness 分层讲清楚。
为什么值得看:这套结构适合复盘 OpenClaw 的 agent 架构,尤其是虚拟文件系统、子 agent、skills 的边界。
原帖链接:https://x.com/shao__meng/status/2068306942184034471
标题/核心观点:Guillermo Rauch 说 agent 让开放 API、文档、测试、CLI、可组合性重新变重要。
为什么值得看:这是 agent infra 的底层判断:不是 UI 包一层,而是软件工程卫生习惯回归。
原帖链接:https://x.com/rauchg/status/2067936390285807940
标题/核心观点:Guillermo Rauch 展示 Eve 的最小 agent 形态:instructions.md + skills。
为什么值得看:它把 agent 产品形态压缩到“Markdown 作为编程语言”,值得对照 OpenClaw skill 体系。
原帖链接:https://x.com/rauchg/status/2068165988005380478
标题/核心观点:Aaron Levie 强调 agent 成功变量在于能否拿到完成工作所需上下文。
为什么值得看:这句话击中企业 AI 痛点:权限、文件、业务对象、历史决策比模型参数更影响结果。
原帖链接:https://x.com/levie/status/2068068247413694532
标题/核心观点:Peter Yang 对 Codex 工作流的体验反馈。
为什么值得看:虽然是个人体验,但能看到 coding agent 的竞争焦点转向速度、模式切换和日常工作占比。
原帖链接:https://x.com/petergyang/status/2068175172960690266
标题/核心观点:Codex remote/local handoff 的工作流讨论。
为什么值得看:远程与本地交接会成为 agent 产品的关键能力,OpenClaw 也需要把 cron、会话、文件、浏览器状态打通。
原帖链接:https://x.com/thsottiaux/status/2068120572673077274
标题/核心观点:Agent Builder 持久化记忆层:情景、语义、程序记忆分层。
为什么值得看:这是企业 agent 从 demo 走向生产必须补齐的模块,可直接转化为 OpenClaw memory schema 设计参考。
标题/核心观点:OpenRouter vs LiteLLM 的网关取舍。
为什么值得看:ABU9 做企业 AI 交付时,模型网关是控制成本、合规、故障切换的基础设施,不应锁死在单供应商。
链接:https://github.com/BerriAI/litellm
标题/核心观点:Humanize PPT v0.9 面向演讲重新组织 PPT skill。
为什么值得看:它把“生成 PPT”拆成受众、状态、转移、预览、质检和演讲模式,适合 ABU9 售前方案自动化借鉴。
链接:https://github.com/search?q=LearnPrompt+humanize-ppt&type=repositories
标题/核心观点:BestBlogs 今日接口空数据。
为什么值得看:这不是内容推荐,而是数据源质量提示;后续自动日报应在采集脚本中把 success=true,data=null 视为软失败并触发备用源。
七、对我们有用的行动建议
把 ABU9 AI 产品路线拆成三类 skill 包。 第一类售前方案/PPT/演示资产,第二类交付审计/代码与文档知识图谱,第三类车企业务助手/经销商话术/智能展厅。
给 OpenClaw 补一层 agent 运行时质量门。 默认检查破坏性命令、外发消息、配置变更、花费、真实身份使用;Claude Code 的安全默认值可以直接借鉴。
做一个“行业上下文包”而不是只做 RAG。 每个客户项目沉淀业务对象、接口、历史决策、交付清单、验收标准、风险项,让 agent 在上下文足够时再执行。
模型网关先留抽象层。 OpenRouter/LiteLLM 任选其一都不重要,重要是保留路由、预算、日志、模型替换和私有化部署能力。
GitHub 热点建立降噪规则。 对异常 star、短描述、灰产关键词、重复出现项目降权;只把能跑、能复用、能映射 ABU9/OpenClaw 的项目进 watchlist。
八、今日结论
今天最重要的变化不是某个模型发布,而是 agent 生态正在补齐“运行时、技能、记忆、沙箱、部署、成本网关”这套企业化骨架;ABU9/OpenClaw 应顺势把行业经验产品化为可执行 skill 和可审计工作流。