Agent 竞争从“模型更强”转到“运行时更完整”。 Codex 长运行云端环境、Cursor Auto-review、Replit Skills、Perplexity Computer 都在补权限、沙箱、工具、审查和持久会话。
今日重点项目雷达
alibaba/open-code-review
是什么:阿里开源的混合架构代码审查工具,把确定性规则流水线与 LLM Agent 结合,支持行级评论、NPE/线程安全/XSS/SQL 注入等规则,兼容 OpenAI 与 Anthropic。;判断标签:趋势增强
Source ↗nexu-io/html-video
是什么:面向 coding agents 的 HTML 转 MP4 工具,支持本地渲染、模板、配乐,定位为“programmatic video”。;判断标签:趋势增强
Source ↗diffusionstudio/lottie
是什么:用 Claude Code 或 Codex 生成生产可用 Lottie 动画的 TypeScript 项目。;判断标签:趋势增强
Source ↗butterbase-ai/butterbase
是什么:开源 backend-as-a-service,覆盖 Postgres、auth、storage、functions、AI gateway、MCP。;判断标签:新变量
Source ↗GordenSun/GordenPPTSkill
是什么:AI 友好的 PPT 构建 Skill,提供中文 PPTX 模板和基于 python-pptx 的非破坏式文本编辑。;判断标签:趋势增强
数据来源:AI HOT + GitHub 近期爆发项目 + BestBlogs 今日精选 + Follow Builders 建造者 feed + 必要核实。筛选标准:实时性、增速、AI/Agent 相关度、对 ABU9/OpenClaw 的启发。
降级项:采集脚本中的 GitHub Search 匿名桶触发 403 rate limit,已用本机
gh api认证请求按created/pushed/stars窗口补采;BestBlogs 今日接口返回success=true但data=null,本栏以 Follow Builders、AI HOT 中的教程/官方博客/长观点替代;Telegram 正文长度如被截断,以 HTML 版为准;Wiki 已同步后运行质量门。
一、今日主线判断
Agent 竞争从“模型更强”转到“运行时更完整”。 Codex 长运行云端环境、Cursor Auto-review、Replit Skills、Perplexity Computer 都在补权限、沙箱、工具、审查和持久会话。
企业 AI 的落点正在从 Copilot 入口变成关键系统嵌入。 Anthropic-DXC、OpenAI-BBVA、腾讯混元 Infra、阿里 Meoo CLI 都说明:真正付费场景在部署、治理、流程改造和工程交付。
Skill/Plugin 正在成为 AI 产品的新包装单位。 Grok 插件市场、Replit Skills、Claude/Codex 生态里的设计、PPT、审查、行业技能仓库,说明“可安装能力包”比单次 prompt 更可复用。
GitHub 热度信号需要强降噪。 近 90 天项目里出现极高 star 与描述异常项目,不能按总 star 直接排序;今天主榜只使用近期创建/更新、与 Agent/企业 AI/设计 artifact 强相关、且能解释业务价值的项目。
对 ABU9/OpenClaw 的核心动作:做行业 Skill 包,而不是泛 Agent 展示。 汽车销售助手、智能展厅、售前方案、交付审计、门店内容生成,应先沉淀成“可运行 Skill + 审查门 + HTML/PPT artifact”。
二、GitHub 近期爆发项目
alibaba/open-code-review
- 是什么:阿里开源的混合架构代码审查工具,把确定性规则流水线与 LLM Agent 结合,支持行级评论、NPE/线程安全/XSS/SQL 注入等规则,兼容 OpenAI 与 Anthropic。
- 元数据:创建 2026-05-18;stars 6438;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:趋势增强
- 意味着什么:企业不会只买“会写代码”的 Agent,还会要求可审计、可解释、可插规则的质量门;OpenClaw 的开发/交付场景应把 review gate 产品化。
- 链接:https://github.com/alibaba/open-code-review
vercel-labs/zerolang
- 是什么:Vercel Labs 推出的“面向 Agent 的编程语言”项目。
- 元数据:创建 2026-05-15;stars 5006;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:新变量
- 意味着什么:Agent 原生开发范式正在从“让模型读现有代码”走向“给 Agent 设计更适合执行的语言/中间层”;值得观察它是否能降低工具调用与状态管理复杂度。
- 链接:https://github.com/vercel-labs/zerolang
KunAgent/Kun
- 是什么:嵌入应用内的 AI agent workspace,强调 Code 与 Write 两种模式。
- 元数据:创建 2026-05-21;stars 3853;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:趋势增强
- 意味着什么:Agent workspace 正在成为产品内能力,而不是独立 IDE;ABU9 的销售/售后/项目系统可以把“写方案、查知识、生成物料”嵌在业务页面里。
- 链接:https://github.com/KunAgent/Kun
OpenBMB/PilotDeck
- 是什么:任务导向的 AI Agent productivity platform。
- 元数据:创建 2026-05-22;stars 3213;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:趋势增强
- 意味着什么:通用聊天入口正在让位于任务台/工作台;OpenClaw 若服务企业,应把任务、证据、工具调用、产物和复盘放在一个可追踪面板中。
- 链接:https://github.com/OpenBMB/PilotDeck
nexu-io/html-video
- 是什么:面向 coding agents 的 HTML 转 MP4 工具,支持本地渲染、模板、配乐,定位为“programmatic video”。
- 元数据:创建 2026-05-27;stars 2930;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:趋势增强
- 意味着什么:AI artifact 从 HTML/PPT 扩展到视频;汽车门店短视频、车型卖点演示、培训片可以用“结构化数据 + HTML 模板 + 渲染”低成本生产。
- 链接:https://github.com/nexu-io/html-video
diffusionstudio/lottie
- 是什么:用 Claude Code 或 Codex 生成生产可用 Lottie 动画的 TypeScript 项目。
- 元数据:创建 2026-06-04;stars 2389;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-30 stars:>200 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:趋势增强
- 意味着什么:AI coding 正在进入设计资产生产;OpenClaw 的设计/日报/方案系统可把动效、图表、页面组件作为可复用 artifact 输出。
- 链接:https://github.com/diffusionstudio/lottie
shadcn/improve
- 是什么:用最强模型审计代码库并写计划,再交给便宜模型执行的工具。
- 元数据:创建 2026-06-10;stars 2349;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-06-06 stars:>100(gh api认证补采)。 - 判断标签:新变量
- 意味着什么:模型路由开始按任务阶段拆分:强模型做架构/计划/审查,小模型做批量执行;这对 OpenClaw 的成本控制和多 agent 编排很直接。
- 链接:https://github.com/shadcn/improve
MoonshotAI/kimi-code
- 是什么:Kimi Code CLI,定位为 next-gen agents 的起点。
- 元数据:创建 2026-05-22;stars 2282;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:趋势增强
- 意味着什么:国产 coding agent CLI 继续补位,企业客户会更关注国产模型、私有化、合规与成本;ABU9 项目可保留国产模型适配层。
- 链接:https://github.com/MoonshotAI/kimi-code
butterbase-ai/butterbase
- 是什么:开源 backend-as-a-service,覆盖 Postgres、auth、storage、functions、AI gateway、MCP。
- 元数据:创建 2026-05-20;stars 1968;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:新变量
- 意味着什么:AI 应用后端开始把 MCP/AI gateway 作为基础能力;企业 Agent 平台不应只管模型调用,还要管身份、数据、函数和工具网关。
- 链接:https://github.com/butterbase-ai/butterbase
GordenSun/GordenPPTSkill
- 是什么:AI 友好的 PPT 构建 Skill,提供中文 PPTX 模板和基于
python-pptx的非破坏式文本编辑。 - 元数据:创建 2026-05-27;stars 1948;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-05-14 stars:>500 AI OR agent OR LLM OR codex OR claude(gh api认证补采)。 - 判断标签:趋势增强
- 意味着什么:PPT/汇报材料是企业 AI 最容易变现的 artifact;ABU9 售前方案、客户周报、项目复盘应先沉淀模板和数据字段。
- 链接:https://github.com/GordenSun/GordenPPTSkill
三、最近 7 天新项目:值得点开
XiaomiMiMo/MiMo-Code
- 是什么:小米 MiMo 相关代码仓库,当前描述缺失但短期 star 激增。
- 元数据:创建 2026-06-10;stars 6572;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-06-06 stars:>100(gh api认证补采)。 - 判断标签:待验证
- 意味着什么:国产大厂 coding/model 项目传播很强,但描述缺失时不能按 star 直接入主跟踪;需复核 README、release、模型卡和 benchmark。
- 链接:https://github.com/XiaomiMiMo/MiMo-Code
NoopApp/noop
- 是什么:离线 WHOOP companion,通过蓝牙配对设备,数据保留在本地,无云、无账号、无订阅。
- 元数据:创建 2026-06-07;stars 1528;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-06-06 stars:>100(gh api认证补采)。 - 判断标签:新变量
- 意味着什么:虽然不是 AI 项目,但“本地优先 + 设备数据 + 隐私”是车端/店端 AI 的关键约束;ABU9 可参考其本地数据主权产品语言。
- 链接:https://github.com/NoopApp/noop
nerding-io/n8n-nodes-mcp
- 是什么:n8n 的 MCP 节点扩展,让自动化工作流接入 MCP 工具生态。
- 元数据:创建 2026-06-06;stars 675;最近更新 2026-06-12;采集窗口/来源查询
created:>=2026-06-06 stars:>100(gh api认证补采)。 - 判断标签:趋势增强
- 意味着什么:MCP 正在从开发者工具进入低代码自动化;企业流程集成时,n8n/MCP 组合可作为轻量 PoC 路径。
- 链接:https://github.com/nerding-io/n8n-nodes-mcp
jwangkun/claude-for-financial-services-cn
- 是什么:面向 A 股金融场景本地化的 Claude Skills 集合,改编自 Anthropic 金融服务技能。
- 元数据:创建 2026-06-07;stars 约 355;最近更新 2026-06-11;采集窗口/来源查询
created:>=2026-06-06 stars:>100(采集脚本候选 + GitHub 补查)。 - 判断标签:趋势增强
- 意味着什么:行业 Skill 包是企业 AI 落地的轻量产品形态;ABU9 可照这个结构做汽车销售、售后、交付审计、经销商经营分析 Skill。
- 链接:https://github.com/jwangkun/claude-for-financial-services-cn
Tencent-Hunyuan/UniRL
- 是什么:腾讯混元开源的统一多模态模型强化学习框架。
- 元数据:创建 2026-06-08;stars 约 518;最近更新 2026-06-11;采集窗口/来源查询
created:>=2026-06-06 stars:>100(采集脚本候选 + GitHub 补查)。 - 判断标签:新变量
- 意味着什么:多模态 RL 工程化会影响未来视频、图像、工具调用 Agent 的训练与评估;对 ABU9 暂时是技术观察,不是马上落地工具。
- 链接:https://github.com/Tencent-Hunyuan/UniRL
JimLiu/baoyu-design
- 是什么:把 Claude Design 本地化为 Agent Skill,可生成 UI mockup、prototype、deck、wireframe,并支持设计系统导入。
- 元数据:创建 2026-06-07;stars 约 765;最近更新 2026-06-11;采集窗口/来源查询
created:>=2026-06-06 stars:>100(采集脚本候选 + GitHub 补查)。 - 判断标签:趋势增强
- 意味着什么:设计能力正在变成可安装 Skill;OpenClaw 当前技能体系应继续沉淀可复用设计系统和行业模板。
- 链接:https://github.com/JimLiu/baoyu-design
amElnagdy/guard-skills
- 是什么:面向 coding agents 的质量门技能,用于捕捉 AI 生成代码、测试、文档中的常见失败模式。
- 元数据:创建 2026-06-06;stars 约 568;最近更新 2026-06-11;采集窗口/来源查询
created:>=2026-06-06 stars:>100(采集脚本候选 + GitHub 补查)。 - 判断标签:趋势增强
- 意味着什么:Agent 工程化的第二层护城河是 guardrail;OpenClaw 的日报、Wiki、开发任务都应该保留质量门,不靠人工记忆兜底。
- 链接:https://github.com/amElnagdy/guard-skills
xiaohuailabs/xiaohu-video-translate
- 是什么:本地完成视频下载、转写、翻译、润色、字幕烧录的一条龙工具。
- 元数据:创建 2026-06-08;stars 约 463;最近更新 2026-06-10;采集窗口/来源查询
created:>=2026-06-06 stars:>100(采集脚本候选 + GitHub 补查)。 - 判断标签:新变量
- 意味着什么:本地内容流水线会降低培训、销售话术、售后教程多语言化成本;ABU9 可把门店培训视频处理成标准流程。
- 链接:https://github.com/xiaohuailabs/xiaohu-video-translate
四、AI 热点新闻
Anthropic 与 DXC 达成全球联盟,将 Claude 引入关键行业系统
- 事件:DXC 将培训大量 Claude 认证前沿部署工程师,并把 Claude 引入银行、航空、保险、政府等关键系统;内部 OASIS 平台称 95% 代码由 Claude 编写,速度提升 10 倍。
- 可信度:一手发布;量化效果为官方案例口径,待第三方验证。
- 意味着什么:Anthropic 正在把 Claude 从工具卖法推进到 FDE/行业交付体系;ABU9 的 AI 转型也应配“行业部署工程师 + Skill 包 + 审查门”。
- 链接:https://www.anthropic.com/news/dxc-anthropic-alliance
Anthropic 发布首次 Public Record 调查
- 事件:Anthropic 对约 5.2 万美国人做公众调查,显示公众既期待 AI 治愈疾病、辅助残障,也高度担忧失业、隐私、儿童安全与责任归属。
- 可信度:一手发布;样本和结论按官方方法解读。
- 意味着什么:企业 AI 方案不能只写效率提升,必须写治理、责任、员工再培训和安全边界。
- 链接:https://www.anthropic.com/news/anthropic-public-record
Cursor 推出 Auto-review,用分类器智能体动态管控工具调用风险
- 事件:Cursor 在工具调用前加入分类器 Agent,根据上下文判断动作是否符合用户意图,高风险动作阻断并解释。
- 可信度:一手发布
- 意味着什么:Agent 权限治理会成为企业采购和落地的必答题;OpenClaw 应把敏感文件、外发消息、生产数据操作做成统一审查层。
- 链接:https://cursor.com/blog/auto-review
OpenAI 计划收购 Ona,强化 Codex 长运行云端环境
- 事件:OpenAI 宣布计划收购 Ona,用于拓展 Codex,提供安全、持久的云端环境,支持企业工作流中的长时间运行 AI Agent。
- 可信度:一手发布
- 意味着什么:长任务、持久沙箱、企业权限是 coding agent 竞争核心;OpenClaw 若要做企业级,需要把会话、节点、文件、审计、回滚全部产品化。
- 链接:https://openai.com/index/openai-to-acquire-ona
OpenAI 推出 Codex 浏览器开发者模式
- 事件:OpenAI Developers 称 Codex 可在 Chrome 和内置浏览器中使用 CDP 调试页面,分析控制台、网络、性能和页面状态。
- 可信度:一手发布
- 意味着什么:浏览器 Agent 不再只是点击网页,而是接入 DevTools 级诊断;OpenClaw 的 browser-harness 应重点沉淀 CDP、截图、日志、像素检查能力。
- 链接:https://x.com/OpenAIDevs/status/2065226355495895521
OpenAI Codex 推出速率重置攒存功能
- 事件:OpenAI 称 Codex 用户可把一次 rate limit reset 保留到自己方便时使用,先面向 Go、Plus、Pro、Business 用户推出。
- 可信度:一手发布
- 意味着什么:AI coding 已经进入“额度运营”阶段;OpenClaw 长任务应记录预算、消耗、失败重试,避免夜间任务卡在额度上。
- 链接:https://x.com/OpenAI/status/2065225362544726371
MiniMax 发布开源权重模型 M3
- 事件:MiniMax 宣布 M3 约 428B 总参数、23B 激活参数,强调 coding、agent、长上下文与多模态能力,权重与技术报告预计约 10 天后发布。
- 可信度:一手发布;benchmark 与能力描述待第三方验证。
- 意味着什么:国产开源权重模型继续补 coding/agent 能力;企业私有化方案可纳入候选,但要等权重、许可证、评测和部署成本清楚后再选型。
- 链接:https://x.com/MiniMax_AI/status/2065436935188058208
Kimi 发布并开源 Kimi-K2.7-Code
- 事件:Kimi 宣布 K2.7-Code 发布并开源,称代码 benchmark、推理效率和长时编码任务成功率提升。
- 可信度:一手发布;官方 benchmark 待第三方验证。
- 意味着什么:coding model 的国产竞争加速,ABU9/OpenClaw 应保持模型适配层,不把工具链锁死在单一供应商。
- 链接:https://x.com/Kimi_Moonshot/status/2065377579130142937
字节豆包上线“任务模式”
- 事件:豆包大范围上线任务模式,支持定时执行、代码运行、文件生成、网页生成、PPT、数据可视化等 Agent 执行链路。
- 可信度:媒体报道
- 意味着什么:C 端入口也在教育用户“AI 可以替你跑任务”;企业端会更快接受定时任务、文件产出、数据分析型 Agent。
- 链接:https://www.ithome.com/0/963/725.htm
Perplexity Computer 集成 Deep Research
- 事件:Perplexity 将 Deep Research 作为 Computer 原生技能,连接搜索、代码生成、长运行沙箱、连接器、工具和授权数据。
- 可信度:一手发布
- 意味着什么:搜索、研究、执行正在合并为 Computer Agent;企业知识工作流会从“搜资料”升级为“搜、算、连系统、产出”。
- 链接:https://x.com/perplexity_ai/status/2065124930463916317
腾讯混元 AI Infra 开源升级 HPC-Ops 推理算子库
- 事件:腾讯混元开源五类推理核心算子,覆盖 Attention、Router GEMM、FusedMoE、Fused AllReduce+Norm、Sampler,并给出多项加速数据。
- 可信度:媒体报道 / 官方公众号;性能数据待第三方验证。
- 意味着什么:国产推理优化继续向生产细节下沉;企业私有化部署的成本竞争会越来越依赖 infra 能力而非单纯模型选择。
- 链接:https://mp.weixin.qq.com/s/y0vd1cpvWXLSssL1kXxguw
Prometheus 融资 120 亿美元、估值 410 亿美元的说法流传
- 事件:X 上流传 Bezos 相关 AI 公司 Prometheus 以高估值融资,定位“人工通用工程师”。
- 可信度:X 传闻
- 意味着什么:未有一手公告前不能按事实处理;但“AI + 工业数据 + 设计到制造闭环”的叙事值得 ABU9 观察,因为汽车数字化天然拥有流程数据入口。
- 链接:https://x.com/kimmonismus/status/2065097988859744503
五、论文 / 研究 / 观点
olmo-eval:面向模型开发循环的评估工作台
- 观点:AllenAI 发布的 olmo-eval 强调开发阶段反复评测,支持 agentic 和多轮评测,并报告标准误差与最小可检测效应。
- 意味着什么:Agent 评估不能只看一次 demo 成功;OpenClaw 应把任务成功率、回归用例、工具调用错误、成本波动纳入持续评测。
- 链接:https://huggingface.co/blog/allenai/olmo-eval
全自主无人机首次击毙人类士兵的报道需要严肃跟踪
- 观点:如果 New Scientist 报道细节成立,自主武器已从伦理讨论进入实战风险。
- 意味着什么:企业 AI 虽不同于武器系统,但“自主决策边界、人类确认、责任链”会成为所有 Agent 系统的共同治理问题。
- 链接:https://www.newscientist.com/article/2529849-fully-autonomous-drones-have-killed-human-soldiers-for-the-first-time
LLM 在核危机模拟中高频选择战术核武器的研究提醒
- 观点:相关模拟称 LLM 在 95% 的场景中选择使用战术核武器,具体模型和实验设置需复核。
- 意味着什么:高风险场景不能把模型输出直接当决策;ABU9/OpenClaw 的生产流程也要定义“只建议、不自动执行”的红线。
- 链接:https://www.kennethpayne.uk/p/shall-we-play-a-game
Swyx 的 Loopcraft 观点:下一阶段是会堆循环的人胜出
- 观点:Swyx 认为未来竞争在于有效堆叠循环:出问题时能下钻提高可靠性,模型变强时能上升放大杠杆。
- 意味着什么:OpenClaw 不应只做单任务 Agent,而要沉淀“采集-判断-生成-质量门-Wiki-发布”的复利循环。
- 原帖链接:https://x.com/swyx/status/2065307558198567206
OpenRouter 基准探索器强化“性能-价格-场景”的模型选择思路
- 观点:OpenRouter 推出多基准帕累托曲线,说明模型选择正在从单榜排名转向多维权衡。
- 意味着什么:OpenClaw 的模型路由不应只按“最强模型”,而要按任务风险、上下文、延迟、成本、工具调用成功率选型。
- 链接:https://x.com/OpenRouter/status/2065094780271329729
六、今天值得读 / 值得看(BestBlogs / Follow Builders 精选)
标题/核心观点:Swyx 说 AI coding 平台缺的是“一次性吞掉 webmaster infra”的闭环。
为什么值得看:这正是 OpenClaw 的机会:把监控、错误反馈、部署、分析、技能安装、告警合并为一套运行时,而不是让用户到处装工具。
标题/核心观点:Amjad Masad 认为 Fable 上 Replit 后,vibecoding 更需要便宜和快速,而不是继续堆 IQ。
为什么值得看:这支持“强模型规划 + 便宜模型执行 + 审查门”的路线;OpenClaw 的夜间任务尤其需要成本分层。
标题/核心观点:Replit 分享专家级提示词技巧。
为什么值得看:面向 Agent 的提示词正在变成可复制的产品方法,ABU9 内部可以把售前、交付、客户访谈提示词沉淀成标准 Skill。
标题/核心观点:Spec 驱动开发三件套覆盖 Spec -> Implement -> Verify。
为什么值得看:这与企业交付天然一致:需求规格、技术规格、变更验证必须随 PR/交付物一同保存。
标题/核心观点:qiaomu-ai-prd 把一句话需求转成 AI 更容易执行的 PRD。
为什么值得看:Agent 开发不是“人喜欢的 PRD”,而是机器可执行规格;ABU9 项目可把客户需求转成结构化 PRD 再进入开发/交付。
标题/核心观点:小互开源公众号自动排版技能组合。
为什么值得看:内容发布链路正在 Skill 化;ABU9 的客户周报、案例文章、售后通知可用同类方式降低人工编辑成本。
标题/核心观点:baoyu-design skill 支持导入 Figma 本地文件重建设计系统。
为什么值得看:设计系统成为 Agent 输入资产后,企业 UI/方案/原型可保持一致风格;OpenClaw 应强化“本地设计系统 + artifact 输出”。
标题/核心观点:Anthropic Claude Corps 项目用 Claude 培训并支持非营利组织。
为什么值得看:这是“模型公司 + 人才训练 + 场景部署”的组织打法,和 DXC 联盟一起说明 FDE 化是 Anthropic 的主线。
七、对我们有用的行动建议
OpenClaw 增加统一 Auto-review 层。 把外发消息、生产数据、删除/配置变更、花钱 API、真实身份使用做成可配置风险分类器,输出“放行/阻断/请示”。
ABU9 先做 4 个行业 Skill 包。 销售顾问话术、智能展厅讲解、售前方案/PPT、交付审计/周报;每个 Skill 必须有输入字段、输出 artifact、质量门和复核条件。
建立模型路由与成本观测表。 对 coding、研究、PPT、HTML、长文、翻译、数据分析分别记录模型、成本、失败率和人工返工率,避免“强模型通吃”。
把汽车业务知识库拆成可执行规格。 不只存文档,要转成客户画像、车型卖点、流程节点、常见异议、系统字段、权限边界,方便 Agent 调用。
用 Wiki 做趋势记忆,而不是日报归档。 每天只沉淀 claim、项目、玩家、行动建议和复核条件;重复出现三次的趋势才升权进入 ABU9 路线图。
八、今日结论
AI 世界今天最明确的方向是:模型能力继续涨,但真正可落地的价值正在转向 Agent 运行时、行业 Skill 包、审查门、成本路由和可交付 artifact;ABU9/OpenClaw 应把这些做成体系,而不是追热点做演示。