Agent 正在从“聊天入口”变成“可发现、可编排、可迁移的运行时”。 Vercel Eve、Google ARD/OKF、OpenRouter Subagent、Cloudflare One stack 都在把工具、技能、目录、注册表和权限变成标准化基础设施,OpenClaw 方向是对的,但需要更强的 registry、policy 和可观测层。
今日重点项目雷达
vercel/eve
是什么:Vercel 新开源的 Agent 框架,把一个 Agent 表示为文件目录,目录映射模型、指令、工具、技能、连接与子 Agent。;判断标签:趋势增强
Source ↗omnigent-ai/omnigent
是什么:AI agent framework / meta-harness,可编排 Claude Code、Codex、Cursor、Pi 与自定义 agents。;判断标签:趋势增强
Source ↗nexu-io/html-video
是什么:面向 coding agents 的 HTML-to-video 本地生成工具,支持模板、渲染引擎和 MP4 输出。;判断标签:趋势增强
Source ↗tastyeffectco/sandboxd
是什么:自托管开发沙箱与 preview URL,一条命令启动,不依赖 Kubernetes,定位 coding agents 和 SaaS factories。;判断标签:趋势增强
Source ↗数据来源:AI HOT + GitHub 近期爆发项目 + BestBlogs 今日精选 + Follow Builders 建造者 feed + 必要核实。筛选标准:实时性、增速、AI/Agent 相关度、对 ABU9/OpenClaw 的启发。
降级说明:BestBlogs public_today 接口本次返回 success 但 data=null,今日“值得读 / 值得看”主要由 Follow Builders 与 AI HOT 一手/准一手来源补齐;GitHub 项目元数据来自采集脚本
github.ranked_recent,部分updated_at字段在脚本归一化结果中缺失,按“采集日仍被 recently_updated 标记”处理。
一、今日主线判断
Agent 正在从“聊天入口”变成“可发现、可编排、可迁移的运行时”。 Vercel Eve、Google ARD/OKF、OpenRouter Subagent、Cloudflare One stack 都在把工具、技能、目录、注册表和权限变成标准化基础设施,OpenClaw 方向是对的,但需要更强的 registry、policy 和可观测层。
Design / Office / PPT 成为 AI 工作台的高频落点。 Claude Design 联动 Replit、xAI Grok for PowerPoint、baoyu-design 视频导出、GordenPPTSkill 爆发,说明“生成 artifact 并接入现有办公流”比单纯聊天更接近企业付费。
机器人与物理世界 AI 开始进入 Agent 评估视野。 Qwen-RobotManip/Nav/World、NVIDIA ENPIRE、Strands Robots SDK 把多模态、工具调用、仿真到硬件迁移合在一起,汽车数字化里的试乘试驾、车间、展厅机器人场景值得提前建知识层。
模型能力发布越来越依赖 benchmark 叙事,但可信度必须分层。 Grok 4.3、Cartesia、Qwen、Google AMIE 都带排名或显著提升数字,正式发布可记录,但成本、排名、效果提升要保留“待第三方验证”。
AI 编程工具进入“多 Agent 团队 + 沙箱 + 长任务”的竞争段。 Eve、Omnigent、Junction、Flock、sandboxd、Codex rate-limit 讨论共同指向:下一阶段不是哪个模型更聪明,而是谁能稳定跑完复杂任务。
二、GitHub 近期爆发项目
vercel/eve
- 是什么:Vercel 新开源的 Agent 框架,把一个 Agent 表示为文件目录,目录映射模型、指令、工具、技能、连接与子 Agent。
- 元数据:创建 2026-06-16;stars 508;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, high_velocity, recently_updated。 - 判断标签:趋势增强
- 意味着什么:Agent 运行时正在“文件系统化”,这和 OpenClaw 的 skill、workspace、tool 权限天然同构,值得研究其目录协议、checkpoint、人审与 telemetry 设计。
- 链接:https://github.com/vercel/eve
Plaer1/junction
- 是什么:面向本地 AI coding agents 的 VS Code chat sidebar。
- 元数据:创建 2026-06-17;stars 498;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, high_velocity, recently_updated。 - 判断标签:新变量
- 意味着什么:AI coding 的入口继续贴近 IDE 侧边栏,本地 agent 不只是 CLI,OpenClaw 若要进入企业开发者环境,需要考虑“轻入口 + 本地上下文 + 权限边界”。
- 链接:https://github.com/Plaer1/junction
XiaomiMiMo/MiMo-Code
- 是什么:小米 MiMo Code,主张模型与 Agent 协同演化。
- 元数据:创建 2026-06-10;stars 9559;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, high_velocity, recently_updated;过去 7 日出现 2 次。 - 判断标签:趋势增强
- 意味着什么:国内厂商正在把模型、工具调用和代码 Agent 打成完整栈;对 ABU9 的启发是不要只评模型,要评“模型 + 工具协议 + 办公/交付生态”的总成本。
- 链接:https://github.com/XiaomiMiMo/MiMo-Code
mrtooher/fable-mode
- 是什么:Claude skill,强调多阶段规划、子 Agent 委派与自验证。
- 元数据:创建 2026-06-13;stars 456;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, high_velocity, recently_updated。 - 判断标签:趋势增强
- 意味着什么:Skill 正在承担“行为操作系统”的角色,不只是提示词包。OpenClaw 的 durable skill 应继续沉淀执行纪律、质量门和子任务协议。
- 链接:https://github.com/mrtooher/fable-mode
omnigent-ai/omnigent
- 是什么:AI agent framework / meta-harness,可编排 Claude Code、Codex、Cursor、Pi 与自定义 agents。
- 元数据:创建 2026-06-11;stars 3435;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, repeat_downgrade, high_velocity, recently_updated;过去 7 日出现 4 次。 - 判断标签:趋势增强
- 意味着什么:多 harness 编排从内部工具走向开源,OpenClaw 需要把“多 agent 会话、权限、日志、失败恢复”作为差异化,而不是只接更多模型。
- 链接:https://github.com/omnigent-ai/omnigent
esengine/DeepSeek-Reasonix
- 是什么:围绕 DeepSeek prefix-cache 稳定性设计的终端 AI coding agent。
- 元数据:创建 2026-04-21;stars 22902;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:active_90d, high_velocity, recently_updated。 - 判断标签:新变量
- 意味着什么:低成本模型的 agent harness 会继续冲击 OpenAI/Anthropic 默认栈,企业 AI 应把模型路由和缓存收益纳入验收指标。
- 链接:https://github.com/esengine/DeepSeek-Reasonix
nexu-io/html-video
- 是什么:面向 coding agents 的 HTML-to-video 本地生成工具,支持模板、渲染引擎和 MP4 输出。
- 元数据:创建 2026-05-27;stars 3250;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_30d, high_velocity, recently_updated。 - 判断标签:趋势增强
- 意味着什么:HTML artifact 正从静态页面扩展到视频,ABU9 的售前方案、培训材料、车展内容可以探索“结构化数据 -> HTML -> 视频”的流水线。
- 链接:https://github.com/nexu-io/html-video
duckbugio/flock
- 是什么:Autonomous AI dev-team bot。
- 元数据:创建 2026-06-08;stars 626;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_14d, recently_updated。 - 判断标签:待验证
- 意味着什么:名字和描述都指向“AI 开发团队”,但信息量不足;可作为多 Agent 团队产品观察样本,不宜立即投入。
- 链接:https://github.com/duckbugio/flock
tastyeffectco/sandboxd
- 是什么:自托管开发沙箱与 preview URL,一条命令启动,不依赖 Kubernetes,定位 coding agents 和 SaaS factories。
- 元数据:创建 2026-06-03;stars 667;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_14d, recently_updated。 - 判断标签:趋势增强
- 意味着什么:沙箱是 Agent 工程化底座。OpenClaw 如果要做企业可用,必须把预览、隔离、资源限制、日志留痕做成默认能力。
- 链接:https://github.com/tastyeffectco/sandboxd
h4ckf0r0day/obscura
- 是什么:面向 AI agents 与 web scraping 的 headless browser。
- 元数据:创建 2026-04-13;stars 15870;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:active_90d, high_velocity, recently_updated。 - 判断标签:趋势增强
- 意味着什么:浏览器 harness 仍是 Agent 必争基础设施,和 ABU9 的竞品监控、招投标信息采集、经销商网页自动巡检高度相关。
- 链接:https://github.com/h4ckf0r0day/obscura
三、最近 7 天新项目:值得点开
alchaincyf/loop-engineering-orange-book
- 是什么:Loop Engineering 橙皮书,中英双语 PDF,解释 loop engineering。
- 元数据:创建 2026-06-15;stars 608;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, high_velocity, recently_updated;过去 7 日出现 2 次。 - 判断标签:新变量
- 意味着什么:Agent 工程从 prompt 技巧转向 loop 设计,适合沉淀为 OpenClaw 的执行范式与培训材料。
- 链接:https://github.com/alchaincyf/loop-engineering-orange-book
vorssaint/vorssaint-utils
- 是什么:Vorssaint macOS app。
- 元数据:创建 2026-06-12;stars 583;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, high_velocity, recently_updated。 - 判断标签:待验证
- 意味着什么:增速快但描述不足,暂不进入主线判断;后续需核对 README、release 与真实用户反馈。
- 链接:https://github.com/vorssaint/vorssaint-utils
BuilderIO/skills
- 是什么:面向 coding agents 的 skills 集合。
- 元数据:创建 2026-06-10;stars 804;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, high_velocity, recently_updated;过去 7 日出现 2 次。 - 判断标签:趋势增强
- 意味着什么:Skill 生态开始被产品公司系统化维护,OpenClaw skill 市场需要考虑版本、质量门、适用边界和安装信任。
- 链接:https://github.com/BuilderIO/skills
coder/boo
- 是什么:基于 libghostty 的 GNU screen 风格 terminal multiplexer。
- 元数据:创建 2026-06-10;stars 649;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, recently_updated。 - 判断标签:新变量
- 意味着什么:终端复用器重新受到关注,原因是长任务 Agent 需要稳定 session、可恢复和多窗格观察。
- 链接:https://github.com/coder/boo
orange2ai/renwei-writing
- 是什么:面向 AI agent 的“人味儿写作”skill,目标是编辑文字但保留人的表达。
- 元数据:创建 2026-06-12;stars 769;最近更新字段缺失;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, repeat_downgrade, high_velocity;过去 7 日出现 4 次。 - 判断标签:噪音降权
- 意味着什么:传播强但重复度高;可作为企业内容润色 skill 的参考,不应占据技术主线。
- 链接:https://github.com/orange2ai/renwei-writing
alchaincyf/fanbox
- 是什么:vibe coding 驾驶舱,左侧文件、右侧/下方终端、中间看 diff。
- 元数据:创建 2026-06-10;stars 622;最近更新 2026-06-18 采集窗口内被标记 recently_updated;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, repeat_downgrade, recently_updated;过去 7 日出现 3 次。 - 判断标签:趋势增强
- 意味着什么:Agent 工作台的关键体验是“文件、终端、diff、审计”同屏,ABU9 内部交付 Agent 也需要让人看清每一步改动。
- 链接:https://github.com/alchaincyf/fanbox
nolangz/pixel2motion
- 是什么:AI logo animation skill,可把位图 logo 转成 SVG 动画、HTML demo、GIF/视频预览与 motion QA 证据。
- 元数据:创建 2026-06-12;stars 702;最近更新字段缺失;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, high_velocity。 - 判断标签:新变量
- 意味着什么:品牌资产自动动效化是营销 artifact 的一个小但实用方向,适合车企展厅屏、公众号封面、活动视频素材。
- 链接:https://github.com/nolangz/pixel2motion
joeseesun/qiaomu-goal-meta-skill
- 是什么:把模糊或复杂 Codex 任务转化为强
/goal命令的 meta skill。 - 元数据:创建 2026-06-11;stars 646;最近更新字段缺失;采集窗口/来源查询
github.ranked_recent,reason_flags:new_7d, repeat_downgrade, high_velocity;过去 7 日出现 3 次。 - 判断标签:趋势增强
- 意味着什么:目标定义正在成为 Agent 成败的前置能力,OpenClaw 可把“目标、约束、验证证据”固化为任务入口。
- 链接:https://github.com/joeseesun/qiaomu-goal-meta-skill
四、AI 热点新闻
Claude Design 新功能并联动 Replit
- 事件:Claude Design 支持跨项目品牌一致、画布编辑、与 Claude Code 同步,并可把设计发送到 Replit 变成可工作的应用。
- 可信度:一手发布
- 意味着什么:设计 artifact 正在进入“生成 -> 编辑 -> 代码实现”的闭环,OpenClaw 可借鉴这种 artifact handoff 机制。
- 链接:https://x.com/claudeai/status/2067325887909884315
- 链接:https://x.com/Replit/status/2067328501003497684
Vercel 发布 Eve 开源 Agent 框架
- 事件:Eve 采用文件系统优先设计,强调持久执行、沙箱、人审、安全连接、多通道和追踪评估。
- 可信度:媒体报道
- 意味着什么:Agent 框架开始把生产能力放在首位,不再只比 tool calling demo;对 OpenClaw 是直接竞品信号。
- 链接:https://www.marktechpost.com/2026/06/17/vercel-releases-eve
Google 发布 Agentic Resource Discovery 开放规范
- 事件:ARD 用 catalog 和 registry 让 AI 工具、技能与智能体可发布、发现和验证。
- 可信度:一手发布
- 意味着什么:未来企业 Agent 能力可能像 API 一样被发现和治理;ABU9 的行业技能、售后工具、经销商数据连接器应考虑可注册化。
- 链接:https://developers.googleblog.com/announcing-the-agentic-resource-discovery-specification
Google Cloud 推出 OKF v0.1
- 事件:OKF 是供应商中立的 Markdown 规范,用 YAML 元数据 + 文件目录为 AI Agent 提供结构化上下文。
- 可信度:媒体报道
- 意味着什么:知识库正在回到“可读文件 + 少量元数据”的路线,和 OpenClaw Wiki/skills 的方向一致。
- 链接:https://www.marktechpost.com/2026/06/16/google-cloud-introduces-open-knowledge-format-okf-a-vendor-neutral-markdown-spec-for-giving-ai-agents-curated-context
OpenRouter 发布 Subagent server tool
- 事件:OpenRouter 允许前沿模型把总结、提取、重排等子任务委托给更小更便宜的 worker 模型。
- 可信度:一手发布
- 意味着什么:模型路由从应用层策略进入生成过程内部,企业 AI 应把“主模型 + worker 模型 + 成本观测”作为标准架构。
- 链接:https://openrouter.ai/blog/announcements/subagent-server-tool
Cloudflare One stack:把 Zero Trust 部署做成 Agent skills
- 事件:Cloudflare 发布可交给 AI Agent 的 skill 文件,用于配置、部署和迁移 Zero Trust 环境。
- 可信度:一手发布
- 意味着什么:厂商最佳实践正在 skill 化;ABU9 可以把汽车行业交付经验转成“售前诊断 skill / 迁移 skill / 巡检 skill”。
- 链接:https://blog.cloudflare.com/cloudflare-one-stack
Qwen 连发机器人操作、导航与世界模型
- 事件:Qwen-RobotManip、Qwen-RobotNav、Qwen-RobotWorld 覆盖机器人操作、导航、具身世界建模,多项 benchmark 声称 SOTA。
- 可信度:一手发布
- 意味着什么:正式发布可记录,但 benchmark 数字需第三方验证;汽车展厅、车间、仓储导航可先做场景知识库,不必立刻押硬件。
- 链接:https://qwen.ai/blog?id=qwen-robotmanip
- 链接:https://qwen.ai/blog?id=qwen-robotnav
- 链接:https://qwen.ai/blog?id=qwen-robotworld
NVIDIA GEAR ENPIRE:8 个 Codex Agent 控制机器人做实验
- 事件:ENPIRE 让多个 Codex Agent 控制机器人并行探索物理任务,带硬件安全限制、token/GPU/机器人利用率指标。
- 可信度:X 传闻
- 意味着什么:方向重要但目前来自 X 线索,需等论文/代码;关键启发是物理 Agent 也需要资源利用率与安全停机指标。
- 链接:https://x.com/DrJimFan/status/2067283904986517866
xAI Grok 4.3 登陆 Amazon Bedrock
- 事件:xAI 宣布 Grok 4.3 在 Bedrock 可用,宣称低幻觉、100 万 token 上下文和多项 benchmark 第一。
- 可信度:一手发布
- 意味着什么:上架 Bedrock 是正式事实;幻觉率、benchmark、每美元智能度属于官方量化主张,需第三方验证后再进采购判断。
- 链接:https://x.ai/news/grok-amazon-bedrock
Google 发布 99 美元 Gemini 智能音箱
- 事件:Google Home Speaker 为 Gemini 打造,支持自然语言、多步指令和连续对话,高级 AI 功能需订阅。
- 可信度:媒体报道
- 意味着什么:家庭入口正在被重新 AI 化,但对 ABU9 更相关的是“语音助手 + 设备控制 + 订阅”的服务模型。
- 链接:https://techcrunch.com/2026/06/17/google-bets-on-gemini-to-reinvent-the-smart-home-speaker
阿里云 HappyOyster 1.0 世界模型
- 事件:阿里云发布开放式世界模型,支持多模态输入、音视频联合生成和实时交互。
- 可信度:媒体报道
- 意味着什么:世界模型可能先在营销、互动展示、虚拟展厅落地;车企数字展厅可以低成本试内容原型。
- 链接:https://www.ithome.com/0/965/652.htm
DeepSeek 融资与估值传闻
- 事件:The Decoder 称 DeepSeek 完成首轮外部融资,估值超 500 亿美元,并继续强调开源与低价。
- 可信度:媒体报道
- 意味着什么:融资数字、估值、折扣幅度不应和正式产品发布同权重;真正要跟踪的是低价模型对企业 Agent 成本结构的影响。
- 链接:https://the-decoder.com/deepseek-takes-outside-money-for-the-first-time-at-a-50-billion-valuation
五、论文 / 研究 / 观点
Anthropic:Claude Code 中专业知识回报持续存在
- 观点:Anthropic 分析大量 Claude Code 会话,认为人类更常决定“做什么”,Claude 更常负责“怎么做”,领域专家能让模型完成更多有效工作。
- 意味着什么:ABU9 的优势不是会不会写 prompt,而是汽车行业 Know-how 能不能结构化成 Agent 可执行上下文。
- 链接:https://www.anthropic.com/research/claude-code-expertise
OpenAI:Deployment Simulation 用真实分布模拟模型上线
- 观点:OpenAI 用历史对话重放候选模型,预测上线后的不良行为,比传统 eval 更接近部署分布。
- 意味着什么:企业 AI 上线前不应只跑 benchmark,要用历史工单、售前问答、交付文档做 shadow replay。
- 链接:https://openai.com/index/deployment-simulation
OpenAI:公开聊天数据可部分预测真实世界失调
- 观点:OpenAI 用 WildChat 模拟部署,发现公开数据集可作为外部审计工具,但对技术性和 agentic 失调预测变差。
- 意味着什么:公共 eval 能看趋势,不能替代企业私有流程回放;OpenClaw 需要私有任务日志评估。
- 链接:https://alignment.openai.com/validating-public-evals
LMSYS:SGLang-JAX 在 TPU 上优化 Ling-2.6-1T
- 观点:通过 Pallas kernel 隐藏 MoE 数据移动,显著改善 TPU 上 MoE 推理吞吐。
- 意味着什么:推理基础设施仍有工程红利;企业采购模型服务时要问清硬件、batch、prefill/decode 成本,而不是只看模型名。
- 链接:https://www.lmsys.org/blog/2026-06-17-ling-2-6-tpu
Google AMIE 长期疾病管理研究
- 观点:Google 称 AMIE 从诊断对话走向长期疾病管理,可交叉引用临床指南并进行管理推理。
- 意味着什么:高风险行业 AI 的价值在“长上下文 + 指南一致 + 可审计推理”,汽车售后诊断也可借鉴,但医疗 benchmark 不能外推。
- 链接:https://blog.google/innovation-and-ai/models-and-research/google-research/amie-for-disease-management-in-nature
六、今天值得读 / 值得看(BestBlogs / Follow Builders 精选)
标题/核心观点:Vercel 的 Agent 沙箱把函数调用拉长到 30 分钟、沙箱寿命拉到 24 小时。
- 为什么值得看:长任务 Agent 的基础设施门槛正在上升,OpenClaw 要尽快把沙箱生命周期、资源预算和恢复策略产品化。
- 原帖链接:https://x.com/rauchg/status/2067137678772937000
标题/核心观点:Codex 欧洲功能与 rate-limit 重置讨论。
- 为什么值得看:一线用户瓶颈仍然是容量、速率和稳定性;企业内部 Agent 也要把“额度体验”做成 SLA。
- 原帖链接:https://x.com/thsottiaux/status/2066956441173323943
标题/核心观点:AI 编程公司被收购传闻背后的真正资产是 agentic harness。
- 为什么值得看:无论 SpaceX-Cursor 传闻真假,“harness 是知识工作自动化核心”这个判断值得跟踪。
- 原帖链接:https://x.com/realmadhuguru/status/2066935654500671499
标题/核心观点:Aaron Levie 认为 Cursor 交易象征应用层 AI 第一个超级成功案例。
- 为什么值得看:企业软件不会只买模型,会买把工作流吃下来的应用层产品;ABU9 应该把 AI 销售助手、智能车间做成应用层闭环。
- 原帖链接:https://x.com/levie/status/2066908002809221496
标题/核心观点:Peter Yang 用 skill 把 Codex/Claude Code 做成个人 advisor。
- 为什么值得看:个人顾问不是单个 prompt,而是少量文件构成的长期上下文与行为协议,这对亮哥个人 OS 和 OpenClaw skills 都有直接价值。
- 原帖链接:https://x.com/petergyang/status/2067056979974160749
标题/核心观点:baoyu-design 本地动画视频导出。
- 为什么值得看:本地 HTML/PPT/视频 artifact 形成一条线,适合售前、培训、汇报材料自动化。
- 链接:https://x.com/dotey/status/2067039941960327204
标题/核心观点:Strands Robots SDK 打通 Hugging Face Hub、LeRobot、仿真和真实机器人。
- 为什么值得看:具身智能的工程入口开始降低,车间/展厅机器人先做仿真流程和数据采集比直接买硬件更稳。
- 链接:https://huggingface.co/blog/amazon/strands-lerobot-hub-to-hardware
标题/核心观点:Grok for PowerPoint 作为 Microsoft 365 插件发布。
- 为什么值得看:PPT/Word/Excel 仍是企业 AI 最短付费路径;ABU9 售前方案、周报、项目复盘都应优先打穿 Office artifact。
- 链接:https://x.ai/news/introducing-powerpoint-addin
七、对我们有用的行动建议
OpenClaw 增加 Agent Registry 设计草案。 参考 Google ARD,把本地 skill、MCP、连接器、Wiki 页面暴露为可发现 catalog,字段至少包括能力、权限、输入输出、风险等级、验证方式。
把 ABU9 交付 Know-how 转成行业 Skill 包。 先做三个:售前方案生成、车企系统巡检、经销商运营诊断;每个 skill 必须带输入模板、工具清单、质量门和输出 artifact。
建立私有任务 replay eval。 用历史售前材料、需求文档、项目日报、客户问题做 Deployment Simulation,评估不同模型/agent harness 的真实可用率与成本。
优先验证 HTML/PPT/视频 artifact 流水线。 组合 baoyu-design、html-video、PPT skill,做“车企月度经营复盘自动生成”demo,比泛聊天更容易让管理层感知价值。
沙箱与成本观测列为企业 Agent 必选项。 跟踪 sandboxd、Eve、OpenRouter Subagent,把运行隔离、模型路由、token/时间/成功率指标纳入 OpenClaw 企业版基本盘。
八、今日结论
AI 世界今天的核心不是某个单点模型突破,而是 Agent 工程栈正在快速产品化:可发现的能力目录、可迁移的 skill、可运行的沙箱、可审计的长任务和可交付的 Office/Design artifact,正好落在 OpenClaw 与 ABU9 企业 AI 的交叉点上。