Agent 从“会聊天”进入“可接管设备/工作环境”。 OpenAI Codex 的 locked-use/Appshots、Google ADK Kotlin/Android、腾讯马维斯都指向同一件事:Agent 正在向 OS、移动端和真实应用窗口下沉,OpenClaw 的浏览器/桌面执行层价值会被放大。
今日重点项目雷达
nexu-io/open-design
是什么:本地优先的开源 Claude Design 替代品,面向网页、桌面、移动原型、幻灯片、图片、视频等多种 artifact 生成。;判断标签:趋势增强
Source ↗esengine/DeepSeek-Reasonix
是什么:围绕 DeepSeek 的终端 AI coding agent,强调 prefix-cache 稳定性和长驻运行。;判断标签:待验证
Source ↗nexu-io/html-anything
是什么:本地 AI agent 写 HTML 的编辑器,覆盖 magazine、deck、poster、XHS/tweet、prototype、data report 等 75 skills × 9 surfaces。;判断标签:趋势增强
Source ↗facebookresearch/vggt-omega
是什么:Meta/Facebook Research 的 CVPR 2026 Oral 项目 VGGT Omega,偏 3D/视觉理解方向。;判断标签:新变量
Source ↗yetone/native-feel-skill
是什么:从 Raycast 2.0 深度拆解中提炼出的跨平台桌面 App 原生体验设计 Agent Skill。;判断标签:趋势增强
Source ↗数据来源:AI HOT + GitHub 近期爆发项目 + BestBlogs 今日精选 + Follow Builders 建造者 feed + 必要核实。筛选标准:实时性、增速、AI/Agent 相关度、对 ABU9/OpenClaw 的启发。采集时间:2026-05-22 04:00(Asia/Shanghai)。
降级说明:BestBlogs 公共早报接口本次返回
success=true但data=null,因此“今天值得读 / 值得看”主要使用 Follow Builders 与一手博客/X 原帖补位;GitHub automotive_agent 查询无结果,汽车相关判断由智能家居、端侧 Agent、FSD 中国传闻等信号间接推导;融资/IPO/盈利/排名类信息均按媒体报道或待核实处理,不与一手发布同权重。
一、今日主线判断
Agent 从“会聊天”进入“可接管设备/工作环境”。 OpenAI Codex 的 locked-use/Appshots、Google ADK Kotlin/Android、腾讯马维斯都指向同一件事:Agent 正在向 OS、移动端和真实应用窗口下沉,OpenClaw 的浏览器/桌面执行层价值会被放大。
企业 AI 的下一道门槛不是模型,而是安全、合规、审计和工具治理。 Anthropic 同日强化安全合规 API 与网络安全案例,说明大客户采购会从“效果演示”转向“可监管、可追责、可接入现有安全栈”。
AI 生成内容正在从单点模型走向生产流水线。 Runway Aleph 2.0、Krea LoRA、PixVerse 广告视频、Kling AI 电影项目共同说明:创作工具竞争点已转向“从素材到成品”的流程集成。
GitHub 热点明显偏向 Skill/Agent 工程化。 zerolang、html-anything、open-design、native-feel-skill、agents-best-practices 等新项目爆发,说明“可复用技能包 + agent-native artifact”正在成为开源注意力中心。
对 ABU9 更现实的机会在“行业 Skill 包 + 审计型 Agent + 端侧/门店场景”。 汽车 Agent 公开项目还少,但 OS Agent、智能家居、端侧翻译、数字人、广告视频都可迁移到智慧展厅、售前陪练、交付审计和经销商内容生产。
二、GitHub 近期爆发项目
nexu-io/open-design
- 是什么:本地优先的开源 Claude Design 替代品,面向网页、桌面、移动原型、幻灯片、图片、视频等多种 artifact 生成。
- 元数据:创建 2026-04-28;stars 48827;最近更新 2026-05-21;采集窗口/来源查询
new_30d_500_ai_agent。 - 判断标签:趋势增强
- 意味着什么:AI artifact 进入“设计系统 + 技能包 + 多端产物”阶段,对 OpenClaw 的 HTML/PPT/原型生成能力有直接参考价值。
- 链接:https://github.com/nexu-io/open-design
op7418/guizang-ppt-skill
- 是什么:面向 Agent 的 HTML 幻灯片技能,强调杂志风、瑞士风、社交封面和低功耗演示 runtime。
- 元数据:创建 2026-04-23;stars 10953;最近更新 2026-05-21;采集窗口/来源查询
new_30d_500_ai_agent。 - 判断标签:趋势增强
- 意味着什么:PPT 不再是单次生成,而是可复用 Skill;ABU9 售前方案、行业汇报可以沉淀为可审计模板。
- 链接:https://github.com/op7418/guizang-ppt-skill
anthropics/claude-for-legal
- 是什么:Anthropic 面向法律工作流的一组插件/能力集合。
- 元数据:创建 2026-04-21;stars 7410;最近更新 2026-05-21;采集窗口/来源查询
new_30d_500_ai_agent。 - 判断标签:趋势增强
- 意味着什么:垂直行业插件化是企业 AI 落地路径;汽车合同、售后索赔、合规文档也可按“行业插件包”方式设计。
- 链接:https://github.com/anthropics/claude-for-legal
esengine/DeepSeek-Reasonix
- 是什么:围绕 DeepSeek 的终端 AI coding agent,强调 prefix-cache 稳定性和长驻运行。
- 元数据:创建 2026-04-21;stars 5185;最近更新 2026-05-21;采集窗口/来源查询
new_30d_500_ai_agent。 - 判断标签:待验证
- 意味着什么:国产/低成本模型 Agent 化仍有强需求,但 benchmark 与稳定性需实测,不能只看 star。
- 链接:https://github.com/esengine/DeepSeek-Reasonix
nexu-io/html-anything
- 是什么:本地 AI agent 写 HTML 的编辑器,覆盖 magazine、deck、poster、XHS/tweet、prototype、data report 等 75 skills × 9 surfaces。
- 元数据:创建 2026-05-11;stars 4461;最近更新 2026-05-21;采集窗口/来源查询
new_14d_200_ai_agent/new_30d_500_ai_agent。 - 判断标签:趋势增强
- 意味着什么:HTML 正成为 Agent 交付的通用容器,适合 OpenClaw 日报、售前材料、门店看板统一产出。
- 链接:https://github.com/nexu-io/html-anything
vercel-labs/zerolang
- 是什么:Vercel Labs 推出的“面向 agents 的编程语言”。
- 元数据:创建 2026-05-15;stars 4179;最近更新 2026-05-21;采集窗口/来源查询
new_7d_100/new_14d_200_ai_agent。 - 判断标签:新变量
- 意味着什么:Agent 运行时可能需要更适合规划、工具调用和状态管理的 DSL;OpenClaw 可关注其抽象是否比自然语言 skill 更可控。
- 链接:https://github.com/vercel-labs/zerolang
BigPizzaV3/CodexPlusPlus
- 是什么:CodexApp 增强工具,目标是让 Codex 更好用、更舒适。
- 元数据:创建 2026-05-06;stars 3919;最近更新 2026-05-21;采集窗口/来源查询
new_30d_500_ai_agent。 - 判断标签:待验证
- 意味着什么:围绕头部 coding agent 的增强层正在成为生态位,但需验证是否只是 UI/快捷操作堆叠。
- 链接:https://github.com/BigPizzaV3/CodexPlusPlus
earthtojake/text-to-cad
- 是什么:面向 CAD、机器人和硬件设计的 agent skills 集合。
- 元数据:创建 2026-04-22;stars 3794;最近更新 2026-05-21;采集窗口/来源查询
new_30d_500_ai_agent。 - 判断标签:新变量
- 意味着什么:Agent skill 从软件/内容扩展到工程设计;汽车零部件、展厅空间、售后工装等垂直场景有迁移空间。
- 链接:https://github.com/earthtojake/text-to-cad
三、最近 7 天新项目:值得点开
facebookresearch/vggt-omega
- 是什么:Meta/Facebook Research 的 CVPR 2026 Oral 项目 VGGT Omega,偏 3D/视觉理解方向。
- 元数据:创建 2026-05-14;stars 1444;最近更新 2026-05-21;采集窗口/来源查询
new_7d_100。 - 判断标签:新变量
- 意味着什么:3D/视觉基础能力继续增强,对智慧展厅、车间巡检、售后影像质检有潜在价值。
- 链接:https://github.com/facebookresearch/vggt-omega
yetone/native-feel-skill
- 是什么:从 Raycast 2.0 深度拆解中提炼出的跨平台桌面 App 原生体验设计 Agent Skill。
- 元数据:创建 2026-05-14;stars 1362;最近更新 2026-05-21;采集窗口/来源查询
new_7d_100/new_14d_200_ai_agent。 - 判断标签:趋势增强
- 意味着什么:Skill 不只是“会做事”,还开始沉淀产品体验标准;OpenClaw 桌面/浏览器 agent 需要这种 UI 规范化能力。
- 链接:https://github.com/yetone/native-feel-skill
thananon/9arm-skills
- 是什么:新建 Skill 集合,描述信息较少但 star 增长快。
- 元数据:创建 2026-05-20;stars 1153;最近更新 2026-05-21;采集窗口/来源查询
new_7d_100。 - 判断标签:待验证
- 意味着什么:Skill 包生态热度高,但该项目需要复核内容质量与许可证,暂不作为工程参考。
- 链接:https://github.com/thananon/9arm-skills
Doorman11991/smallcode
- 是什么:面向小模型优化的 AI coding agent,宣称 4B-active 模型达到 87% benchmark。
- 元数据:创建 2026-05-18;stars 1035;最近更新 2026-05-21;采集窗口/来源查询
new_7d_100/new_14d_200_ai_agent。 - 判断标签:待验证
- 意味着什么:如果成立,低成本本地/私有 coding agent 有价值;但 benchmark 属项目自述,需要第三方复核。
- 链接:https://github.com/Doorman11991/smallcode
DenisSergeevitch/agents-best-practices
- 是什么:面向 Codex、Claude Code 和 agentic harness 设计的 provider-neutral Agent Skill。
- 元数据:创建 2026-05-15;stars 938;最近更新 2026-05-21;采集窗口/来源查询
new_7d_100/new_14d_200_ai_agent。 - 判断标签:趋势增强
- 意味着什么:跨模型、跨 harness 的最佳实践正在标准化,适合纳入 OpenClaw skill 质量门和 ABU9 内部 Agent 使用规范。
- 链接:https://github.com/DenisSergeevitch/agents-best-practices
Kappaemme-git/codex-complexity-optimizer
- 是什么:用于安全代码复杂度分析和性能优化报告的 Codex skill。
- 元数据:创建 2026-05-15;stars 817;最近更新 2026-05-21;采集窗口/来源查询
new_7d_100/new_14d_200_ai_agent。 - 判断标签:趋势增强
- 意味着什么:Coding agent 的价值从“写代码”延伸到审计和报告;ABU9 交付质量巡检可借鉴此模式。
- 链接:https://github.com/Kappaemme-git/codex-complexity-optimizer
bytedance/Lance
- 是什么:字节跳动 3B-active 参数原生统一多模态模型,覆盖图像/视频理解、生成和编辑。
- 元数据:创建 2026-05-15;stars 650;最近更新 2026-05-21;采集窗口/来源查询
new_7d_100。 - 判断标签:新变量
- 意味着什么:小型多模态模型继续压缩部署成本,可能适合门店内容审核、车辆图片理解、短视频生成等边缘场景。
- 链接:https://github.com/bytedance/Lance
四、AI 热点新闻
Codex 支持锁屏状态安全操控 Mac
- 事件:OpenAI Developers 称 Codex 可在 Mac 锁定、屏幕关闭时通过手机安全使用电脑应用。
- 可信度:一手发布
- 意味着什么:桌面 Agent 的边界从“辅助操作”走向“异步托管真实设备”,但企业环境必须同步考虑权限、审计、远程擦除与误操作回滚。
- 链接:https://x.com/OpenAIDevs/status/2057536706778378692
Codex Appshots 上线
- 事件:OpenAI Developers 发布 Appshots,Mac 上按 Command-Command 可把应用窗口截图和文本上下文附加到 Codex 线程。
- 可信度:一手发布
- 意味着什么:Agent 获取 UI 上下文的方式更轻,OpenClaw 浏览器/桌面 harness 可参考“截图 + 隐藏文本 + 线程上下文”的输入设计。
- 链接:https://x.com/OpenAIDevs/status/2057530207976989179
Anthropic 扩展 Claude 安全与合规工具集成
- 事件:Anthropic 宣布通过 Claude Compliance API 新增 28 项安全与合规集成,覆盖 Cloudflare、CrowdStrike、Microsoft Purview 等。
- 可信度:一手发布
- 意味着什么:企业 AI 采购将要求对话、事件、DLP、SIEM 可打通;ABU9 做企业 Agent 时要从第一天设计日志和合规接口。
- 链接:https://claude.com/blog/compliance-api-security-partners
Anthropic 展示 Opus 在网络安全中的生产应用
- 事件:Anthropic 发布合作伙伴用 Opus 做安全测试与漏洞发现的案例,涉及 Wiz、Palo Alto Networks、Accenture 等;量化效果为官方/伙伴自述,需第三方验证。
- 可信度:一手发布
- 意味着什么:安全测试是 Agent 可衡量 ROI 的场景,ABU9 的交付审计、接口扫描、配置巡检可按类似路径做“受控攻击/检查型 Agent”。
- 链接:https://claude.com/blog/how-our-partners-are-putting-opus-to-work-for-cybersecurity
Google 发布 Kotlin ADK 与 Android ADK 0.1.0
- 事件:Google Developers Blog 发布 ADK Kotlin/Android,帮助开发者在后端与 Android 生态构建 AI Agent。
- 可信度:一手发布
- 意味着什么:移动端 Agent SDK 正式化,车主 App、经销商 App、售后技师 App 可逐步嵌入 agentic workflow。
- 链接:https://developers.googleblog.com/adk-kotlin-android-building-ai-agents
Google 推出 Gemini for Home
- 事件:Google 面向服务提供商和硬件伙伴推出 Gemini for Home,提供摄像头智能、自然语言查询、日常活动摘要、参考设计和 API。
- 可信度:一手发布
- 意味着什么:家庭/门店/展厅空间的“情境理解 + 主动摘要”会变成标配;智慧展厅可借鉴摄像头事件摘要与自然语言查询。
- 链接:https://developers.googleblog.com/empowering-service-providers-and-hardware-partners-with-gemini-for-home
Cursor 总结云端智能体构建经验
- 事件:Cursor Blog 复盘 Cloud Agent 基础设施,强调完整开发环境、Temporal 可靠性、agent loop 与机器状态/对话状态解耦。
- 可信度:一手发布
- 意味着什么:长任务 Agent 的核心不是 prompt,而是环境复现、状态机和可靠执行;OpenClaw 可直接吸收为 harness 设计原则。
- 链接:https://cursor.com/blog/cloud-agent-lessons
Runway 发布 Aleph 2.0 与 Edit Studio
- 事件:Runway 正式发布 Aleph 2.0 及 Edit Studio,将生成、编辑、后期制作整合到统一创作平台。
- 可信度:一手发布
- 意味着什么:视频生成竞争进入“一站式工作台”,汽车营销内容生产可以从单条视频生成转为持续创意测试流水线。
- 链接:https://app.runwayml.com/generate?mode=edit
xAI Grok 接入 OpenCode
- 事件:xAI 宣布 SuperGrok 或 X Premium 用户可在 OpenCode 中调用 Grok Build 模型。
- 可信度:一手发布
- 意味着什么:Coding agent 会进入多模型路由竞争,企业内部工具应预留模型适配层,不要绑定单一供应商。
- 链接:https://x.ai/news/grok-opencode
腾讯混元开源 Hy-MT2 多语言翻译模型
- 事件:腾讯混元称 Hy-MT2 支持 33 种语言互译,并提供轻量版本与极量化能力;性能对比属于官方自述,需第三方验证。
- 可信度:一手发布
- 意味着什么:端侧/私有化翻译能力继续下探,车企海外业务、经销商多语种服务、维修手册翻译可关注。
- 链接:https://x.com/TencentHunyuan/status/2057384034544804136
OpenAI IPO 时间表传闻
- 事件:IT之家援引 CNBC 称 OpenAI 可能最快本周五提交 IPO 招股书草案,目标 2026 年 9 月上市。
- 可信度:媒体报道
- 意味着什么:资本市场会放大 AI 平台公司的商业化压力,但上市时间、估值与治理安排在正式文件前均不能当事实使用。
- 链接:https://www.ithome.com/0/953/090.htm
FSD 进入中国大陆传闻
- 事件:X 用户称 FSD 官宣进入大陆,但当前采集仅见社交转述,缺少官方链接。
- 可信度:X 传闻
- 意味着什么:若属实会推动汽车智能化营销与售后咨询需求,但在 Tesla/监管官方确认前,只作为汽车 AI 场景观察信号。
- 链接:https://x.com/xiaohu/status/2057279976467218765
五、论文 / 研究 / 观点
Meta VGGT Omega:3D/视觉基础能力继续增强。 对车间、展厅、车辆影像理解有潜在迁移价值,但需等论文与代码实测。链接:https://github.com/facebookresearch/vggt-omega
OpenAI/数学开放问题信号:通用模型开始进入高难研究辅助。 Sam Altman 称“general-purpose model solved a major open problem in mathematics”,属于官方/人物观点,需等待论文和第三方复核。链接:https://x.com/sama/status/2057203171198636251
Cursor Cloud Agent 经验:可靠性来自工作流基础设施。 Temporal、状态解耦、环境复现,比单纯换模型更影响长任务成功率。链接:https://cursor.com/blog/cloud-agent-lessons
Google ADK Kotlin/Android:Agent SDK 正在平台化。 移动端和后端 workflow 的 SDK 化会降低企业 App 接入 Agent 的门槛。链接:https://developers.googleblog.com/adk-kotlin-android-building-ai-agents
Stainless/MCP 管道观点:Agent 真正需要的是互联网服务的工具化接口。 Anthropic 收购 Stainless 的讨论显示,API schema、SDK、MCP 服务器会成为 Agent 工程底座。链接:https://x.com/danshipper/status/2057122805657821240
六、今天值得读 / 值得看(BestBlogs / Follow Builders 精选)
标题/核心观点:Cursor《Lessons from building agents in the cloud》
- 为什么值得看:这是今天最值得给 OpenClaw harness 设计复盘的文章,讲清了云端 Agent 的环境、可靠性和状态拆分。
- 链接:https://cursor.com/blog/cloud-agent-lessons
标题/核心观点:Anthropic《Claude Compliance API + 28 个安全合规伙伴》
- 为什么值得看:企业 AI 的采购门槛正在从“能不能用”升级为“能不能被监管”。
- 链接:https://claude.com/blog/compliance-api-security-partners
标题/核心观点:Anthropic《Opus for cybersecurity》
- 为什么值得看:安全测试是少数能直接量化 ROI 的 Agent 场景,可迁移到 ABU9 交付审计和接口巡检。
- 链接:https://claude.com/blog/how-our-partners-are-putting-opus-to-work-for-cybersecurity
标题/核心观点:Google ADK Kotlin / Android
- 为什么值得看:移动端 Agent 工程化开始有官方 SDK,车企 App 与经销商 App 的 Agent 化门槛会下降。
- 链接:https://developers.googleblog.com/adk-kotlin-android-building-ai-agents
标题/核心观点:AI-native team 中 IC 要像管理者,管理者要像 IC
- 为什么值得看:这句话适合 ABU9 内部推广 Agent 工作法:个人要会分派/验收 Agent,管理者要重新回到可构建的一线。
- 原帖链接:https://x.com/zarazhangrui/status/2057324988009685208
标题/核心观点:AI 时代开发者/岗位的 T 型能力
- 为什么值得看:领域深度 + 邻域广度 + AI 使用能力,是企业 AI 转型的人才模型。
- 原帖链接:https://x.com/zarazhangrui/status/2057267931025957348
标题/核心观点:Garry Tan 称 Exa 是其 agents 信任的搜索工具
- 为什么值得看:Agent 的 web search/retrieval 质量会直接影响执行质量,OpenClaw 应把搜索供应商作为可替换基础设施。
- 原帖链接:https://x.com/garrytan/status/2057202833251000503
标题/核心观点:Dan Shipper 讨论 Anthropic 收购 Stainless 与 MCP 管道
- 为什么值得看:Agent 要真正使用互联网,需要把 API、SDK、MCP server 做成稳定、可发现、可调用的工具层。
- 原帖链接:https://x.com/danshipper/status/2057122805657821240
标题/核心观点:Google Labs Project Genie:从玩游戏到几分钟设计游戏
- 为什么值得看:生成式交互世界会影响车展互动、品牌活动和门店体验设计。
- 原帖链接:https://x.com/GoogleLabs/status/2057218835074437573
七、对我们有用的行动建议
OpenClaw 增补“桌面/浏览器 Agent 安全审计清单”。 Codex locked-use 说明远程托管真实设备会成为趋势,必须提前定义权限、截图留痕、敏感操作二次确认、回滚和日志字段。
ABU9 做一个“汽车行业 Skill 包”雏形。 先从售前方案、经销商话术、交付审计、接口巡检、培训 PPT 五类高频任务切入,不追求大而全。
把 HTML/PPT artifact 作为交付标准件。 open-design、html-anything、guizang-ppt-skill 的爆发说明 Agent 交付最好落在可审阅、可发布、可复用的 HTML 容器。
为企业客户准备“AI 合规接入故事”。 对标 Claude Compliance API:日志、事件、DLP、权限、审计报表要能讲清楚,哪怕第一版只是轻量实现。
跟踪端侧/移动 Agent 与智能空间。 Google ADK Android、Gemini for Home、Hy-MT2、小多模态模型都指向低成本场景化部署,适合智慧展厅和售后移动工作台。
八、今日结论
今天的核心变化不是某个模型更强,而是 Agent 正在拥有设备入口、工作流基础设施和企业合规外壳;谁能把这些转成行业 Skill 与可审计交付,谁更接近 ABU9/OpenClaw 的真实机会。