企业 AI-Native
的落地路径
模型能力 · 研发交付 · 组织协作
从个人使用 AI,到团队持续交付
编码变快,交付仍然可能排队
需求澄清
口径反复,边界遗漏
编码实现
代码生成与修改加快
验证与评审
证据不足,返工增加
验收与交接
负责人等待,上下文丢失
AI-Native 的三个默认选择
模型能力参与产品定义
先实测模型能稳定完成什么,再发现产品机会,以真实用户价值校准。
人与 Agent 共同承担任务
围绕任务、权限和验收设计分工;人保留关键判断与结果责任。
一手证据支撑决策
阅读原始文档与代码,在自己的任务上评测,持续更新能力边界。
AI-Native 产研与 Agentic 业务职能
AI-Native 产研
Vibe Coding 工程化
- 产品与设计探索
- 编码、测试与代码评审
- 交付、发布与运维辅助
Agentic 业务与职能
把业务流程变成可执行任务
- 数据分析与运营
- 客服与业务服务
- 财务、行政等职能协作
交付效率与新的业务机会
交付更快、更稳定
减少需求反复解释与交接等待
让验证更早发生,降低返工
观察:验收周期、退回原因、任务总成本
更低成本地验证想法
小范围产品试验
按需分析与更细粒度的业务服务
观察:用户是否采用、结果是否有用
用合格交付衡量投入
| 维度 | 观察指标 | 比较时的约束 |
|---|---|---|
| 速度 | 从需求进入到验收的周期 | 包含等待与返工 |
| 质量 | 验收退回、回归缺陷、线上故障 | 同类任务、相同验收口径 |
| 自主程度 | 自主完成率、人工介入原因 | 明确统计终点是待审还是上线 |
| 成本 | 模型 + 环境 + 审核 + 返工 | 观察每个合格任务的总成本 |
五项能力,沿交付链逐步建设
Token 治理
团队用得上
投入看得清
SDD 开发
做什么
怎样算完成
Agent Readable
理解项目
理解业务事实
自主执行闭环
执行与验证
失败时能停下
团队能力复用
下一次少解释
少犯重复错误
多项能力可以并行建设,经验复用从第一次交付开始。
企业内部 Token 中转站
Agent 接入
Codex
WorkBuddy
业务 Agent / 内部工具
统一模型入口
以 New API 等开源项目起步
身份与密钥 · 模型路由
配额限流 · 用量与费用
模型资源
授权的模型 API
企业可管理的调用资源
接得上之后,还要管得清
接入验收
验证鉴权、协议、流式响应与工具调用。为使用者提供配置模板与诊断入口。
资源归属
将密钥与预算关联部门、项目及使用范围;跟踪费用、失败率与异常消耗。
任务关联
把调用记录与需求、PR、测试报告关联,观察返工和审核是否抵消收益。
一个导出需求如何完成交付
需求示意:授权用户按选定字段与时间范围导出客户分析数据。
明确需求
产品确认权限
字段与数据口径
形成规格
记录场景与取舍
拆分实现、验证任务
实现与交付
Agent 实现并验证
研发汇总版本与证据
验收与复用
群内交接给产品
验收后复盘归档
OpenSpec 中的需求与验收场景
Proposal
为何需要导出
哪些用户使用
Specs
权限、字段、日期
可验证的边界场景
Design
复用现有鉴权
确认查询与导出方案
Tasks
实现导出能力
补齐验证与交付任务
示例场景:无权限用户收到拒绝,授权用户只能导出允许范围内的数据。
脚手架补齐交付、决策与复盘工件
| 工件 | 职责 | 生成时机 |
|---|---|---|
| delivery.md | 产品拿什么验收,怎样定位实现 | 研发交付前,完成 handoff 时必备 |
| decisions.md | 哪些取舍已确认,哪些仍阻塞交付 | 存在影响交付的关键决策时按需创建 |
| reflection.md | 哪些问题需要成为共享知识或规则 | 产品验收后、主规格同步与归档前 |
tasks.md 同时跟踪 handoff、acceptance、reflection,区分研发交付、产品验收和复盘完成。
delivery.md 让交付可定位、可复核
交付文档记录什么
摘要与范围、实现版本、验证结果
关键决策、可复现验收清单
风险与回滚、下一棒负责人及动作
何时可以交接
先形成真实 Commit / MR
再生成交付文档、更新 handoff
通知产品负责人进入验收
| 需求 / 场景 | 任务 | 实现位置 | 验证证据与结果 |
|---|---|---|---|
| 无权限用户不能导出 | 权限校验任务 | 导出接口鉴权逻辑 | 可复现的拒绝访问测试 |
验收覆盖矩阵示意:逐项关联 Requirement / Scenario、Task、实现与验证。
需求在仓库中留痕,在群里完成交接
| 状态变化 | 群内接收人 | 下一步 |
|---|---|---|
| 规划工件就绪 / 规格更新 | @ 研发负责人 | 确认需求并实施 |
| 有效交付,进入待验收 | @ 产品负责人 | 按 delivery.md 中的版本与清单验收 |
| 产品验收记录完成 | 单独验收不发通知 | 完成复盘与主规格同步 |
| 需求验收后归档 | 通知研发负责人 | 确认闭环,沉淀后续改进 |
一条待验收消息,需要交代什么
让 Agent 从项目事实开始工作
项目是什么
导出模块与调用关系
鉴权入口、数据模型
启动方式与关键路径
怎样做才合适
AGENTS.md 入口
通用 / 团队 / 项目规则
任务适用的 Skill
怎样证明完成
权限与日期边界测试
检查命令、验收场景
运行证据与失败现场
编码前后,各有一道质量门
方案检查
独立评审
编码前
导出范围与业务口径是否明确?复用哪套权限,是否还有待决事项?
编码后
检查越权、空数据与日期边界,结合调用方和测试证据评审改动。
闭环必须包含失败路径
| 触发条件 | 系统或团队的动作 |
|---|---|
| 需求 / 权限不清 | 暂停相关执行,交给对应负责人 |
| 验证反复失败 | 限制重试,保留现场与失败原因 |
| 时间 / 费用超限 | 停止并交接已有结果 |
| 影响数据、权限或生产环境 | 进入对应人工审批与回滚流程 |
把一次交付留下的经验变成共享能力
交付与验收
记录遗漏的场景
及其复现证据
归类反思
判断是任务特例
还是可复用的知识
确认与沉淀
负责人确认后更新 Rules 或 Skill
复用与退出
按任务加载,失效后更新或归档
企业 AI-Native:两条主线、四层结构
AI-Native 产研
产品与设计 · Coding Agent · 质量与交付
Agentic 业务与职能
业务服务 · 运营分析 · 风险诊断 · 职能管理
企业数字资源统一模型网关
Token 治理业务系统与数据
日志与知识系统侧 MCP Server
受控工具与接口
你的组织在哪个阶段?
没用 AI
尚未纳入工作方式
个人 Vibe Coding
超级个体涌现
Agent 共享
团队协作开始
统一平台 + 治理
AI 原生组织雏形
数据驱动优化
+ Multi-agent 网络
AI 原生组织
据现场照片重绘,用于讨论组织阶段。按任务需要选择协作方式,以交付结果判断价值。
试点起点:一类重复需求
选择任务
选一个团队
明确负责人和验收人
记录基线
等待、返工、人工介入
以及每次交付总成本
跑通一次
规格、验证、交接
直到产品完成验收
决定扩展
比较同类任务结果
再补能力或扩大范围
能否更少解释、更早发现错误?
感谢聆听
期待与各位同行交流实践
杭建@微鲤科技