过去一年,AI 对软件研发的影响,正在从工具辅助走向流程重构。
... 展开 >








长期深耕 Agent 设计、AI 应用实践与复杂工程架构,在相关领域积累了深厚的技术沉淀与丰富的一线落地经验。当前专注于探索 AI Coding 在超大规模复杂工程中的落地实践,研究 AI 驱动下的新型协作关系与研发范式演进。
过去一年,AI 对软件研发的影响,正在从工具辅助走向流程重构。
从 AI Coding 的快速普及,到 Agent 在复杂研发场景中的逐步落地,AI 正以前所未有的速度改变研发方式。代码生成、测试补全、问题定位、知识检索等能力不断成熟,让研发效率获得了可观提升,也推动越来越多团队重新思考研发流程与协作模式。
但与此同时,AI 在真实复杂项目中的落地,仍远未达到理想状态。
相比 Vibe Coding 在快速原型、个人项目与轻量级开发中的高成功率,在大型工程、复杂架构、多端协同与长期演进的研发环境中,AI Coding 依然面临上下文理解不足、工程约束难建模、跨模块协同弱、生成结果稳定性不足等现实挑战。如何让 AI 真正从“辅助写代码”走向“理解工程、融入流程、提升体系效率”,依然是行业正在攻克的核心问题。
随着大模型能力持续演进,研发提效的命题也正在发生变化:从单点效率优化,逐渐延伸到研发链路的系统性提效——包括需求分析、架构设计、代码实现、测试验证、上线运维以及知识沉淀的全流程智能化。
本专题将邀请多位业界领先的技术专家,分享他们在 AI Coding、研发 Agent、工程智能化、复杂项目落地实践与研发效能建设等方向上的探索与思考,共同探讨 AI 驱动下研发体系的演进路径与未来趋势。
随着大模型能力持续提升,AI Coding 已成为研发提效的重要方式。然而,在大型工程、复杂架构和多端协同的真实研发环境中,"一个模型解决一切"的模式逐渐暴露出上下文膨胀、目标漂移、工程约束缺失、结果不可控等问题。如何让 AI 真正理解工程,而不仅仅是生成代码,正成为 AI Coding 走向规模化落地的关键挑战。
本次分享将结合小红书客户端研发 AI 化实践,介绍一套面向复杂工程的 AI Coding 落地方案。围绕"拆解、隔离、约束、感知"四个核心原则,通过任务拆解、多 Agent 协作、结构化中间产物、运行时反馈等工程化手段,让 AI 从"通才模型"演进为能够完成复杂研发任务的"专才 Agent",实现从需求文档、Figma 设计稿到 Android、iOS、鸿蒙等多端可运行代码的全链路自动化研发。
分享将重点介绍 Context Engineering、Agent Harness、多 Agent 协同、Runtime Feedback 等关键技术实践,探讨如何降低上下文复杂度、提升代码生成确定性,并结合多个真实业务案例,分享 AI 在大型客户端工程中的落地经验,以及复杂研发场景下 AI Coding 的工程化演进方向。
演讲提纲
1. AI Coding 为什么在大型工程中失效
2. 核心设计:拆解、隔离、约束、感知
3. Harness 工程实践
4. 真实业务落地效果
5. 总结与展望
实践痛点
落地需要前置产品需求阐述清楚,落地中 Token 消耗量需要进一步压缩,在小红书这样的大型项目效果还有优化空间,并不是一个终极形态。
前沿亮点
详细介绍 AI Coding 在小红书这样一个大型、重 Native 交互、高速发展的客户端落地实践。核心亮点:
听众收益
随着 AI Coding 快速普及,代码生成正逐渐从研发瓶颈变成基础能力,而代码质量、安全性与工程可控性则成为新的核心挑战。越来越多团队开始尝试利用 Agent 自动完成代码评审,但在真实的大规模研发环境中,通用 Agent 往往会面临覆盖不足、定位漂移、质量波动、Token 成本过高等问题,仅依赖 Prompt 和大模型能力难以满足生产级要求。
本次分享将结合阿里 Open Code Review 的建设实践,介绍如何通过确定性工程 + Agent 协同,将通用 Agent 收敛为适用于代码评审场景的垂直领域 Agent。分享将围绕分治并发、精准定位、规则模板引擎、工具链蒸馏、上下文分层管理等关键工程实践,探讨如何将工程逻辑与模型能力结合,让确定性的工作交给工程系统,让需要语义理解的任务交给大模型,实现更高的稳定性、更低的成本和更好的评审质量。
同时,分享还将结合百万真实任务、阿里内部 2 万余名开发者的使用数据以及 Open Code Review 开源项目实践,介绍 AI Review 在生产环境中的效果验证,并进一步探讨 AI 深度参与研发后,如何建立新的评估体系,推动 AI Code Review 从"辅助工具"走向研发流程中的质量基础设施。
演讲提纲
1. AI Coding 普及后,代码评审成为新的效率瓶颈
2. 为什么通用 Agent 难以支撑生产级 Code Review
3. 确定性工程 + Agent 协同:五大工程实践
4. 百万真实任务验证
5. AI 时代如何重新定义研发度量体系
6. 总结与展望
实践痛点
1. 规则模板引擎的维护成本与泛化瓶颈
2. 度量体系本身的维护成本与时效性
演讲亮点
听众收益
过去一年,AI Coding 大幅降低了软件开发门槛,让个人开发者第一次拥有了接近小团队的生产能力。然而,真正决定一个产品能否成功的,并不是代码生成,而是从 Idea、设计、开发、验收到发布、增长的完整产品交付能力。AI 能够帮助写代码,却无法替代产品判断;能够提升单点效率,却不意味着能够完成完整的产品闭环。
本次分享将结合真实产品实践,介绍一套面向 AI 时代独立开发者的完整产品工作流(OPC)。围绕 Idea、设计、实现、验收、发布 五个阶段,分享如何将 AI、自动化工具与 Agent 深度融入产品研发全过程,构建一套能够持续运行、持续迭代、持续增长的产品生产体系,实现从一个想法到真实上线的完整闭环。
分享将重点介绍需求发现、设计生成、AI Coding、运行时验证、自动化部署、增长运营等关键实践,并探讨 AI 如何从“代码助手”逐步演进为覆盖产品全生命周期的数字团队,帮助个人开发者真正迈向“一人公司”的新工作方式。
演讲提纲
1. AI 时代,一人公司正在成为现实
2. Idea:如何找到真正值得做的产品
3. Design:让 AI 理解产品,而不仅是页面
4. Build:AI Coding 如何真正提升研发效率
5. Validate:为什么“写出来”不等于“能上线”
6. Launch:AI 如何参与增长与运营
7. 总结与展望
实践痛点
演讲亮点
听众收益
AI 编程助手把代码的生产速度放大了,验证能力却没有同步跃升。但"多招几个测试"解决不了这件事——我们复盘后发现真正的堵点有两个,且是乘法关系:
判据缺失:AI 不知道"什么算对"。需求、技术方案、基建规范、团队约束都散在文档里,无法被消费,于是 AI 只能追求"看起来能跑通"。
信号缺失:AI 拿不到"对不对"的客观反馈。它看不见屏幕、读不到运行时、点不动按钮、没法把 App 拉到目标状态。我们量化过:AI 生成 100 个用例,环境搭建 60% × 数据构造 50% × 执行 40% × 工具自动化率 70%,综合可执行率只有 6.4%。
任一为零,自主性就是零。TEKO 的答案是同时补两根柱子:
判据侧:把质量能力做成可在任意研发环节调用的 Skill,让"验收条件"成为一个在链路上逐级传递、逐级细化的结构化数据对象:需求文档产出需求验收条件;技术方案 + 基建规范 + 团队约束产出技术验收条件;代码 diff + context7 + 领域知识产出风险点与配套用例;构建产物产出单测 / 白盒 / UI 自动化用例。最反直觉的一步是把验收条件回喂给生码环节——判据先行,这才是 AI 原生的 TDD。
信号侧:把 App 从"只能被人看的交付物"改造成"能被 Agent 寻址、观测、驱动、复现的可编程环境",并往下打到根因:自动化上不去往往不是用例不够,而是系统本身不可测。我们用终端环境全局切面 + SDK 可测性基线与 CI 卡口去改造"物理法则"。
两根柱子合流,Agent 的循环长度才能从 1 变成 N——从"生成后交给人"变成"生成、执行、观测、判断、修复、复跑"全程无人;线上 Crash 与舆情也能反过来自动转化为回归用例,让用例库有机生长而非靠人工建设。本场交底架构、工程取舍、一个可自评的成熟度阶梯(L0→L5),以及量化效果与尚未解决的问题。
演讲提纲
AI 生码放大了生产速度,验证能力没有同步。三个诊断——变更快过用例的老病、"能跑通≠逻辑对"的新伤,以及最易被忽略的根因:系统本身不可测。提出全场骨架:自主性 = 判据 × 信号,二者是乘法关系,只补一边等于没补。
一、判据:把"什么算对"变成可传递的数据:需求文档不适合生成用例,但它是判据的天然来源——判据左移,验证右锚。四级验收条件流水线:需求文档→需求验收条件;技术方案+基建规范+团队约束→技术验收条件;代码 diff+TBContext7+领域知识→风险点与配套用例;构建产物→单测/白盒/UI 用例。最反直觉的一步是把验收条件回喂给生码环节,即 AI 原生的 TDD。含三源上下文(改了什么/影响了谁/意味着什么)、可执行性过滤与双模召回、以及为什么做成 Skill 而非平台。
二、让判据生产线跑得稳:Session-Stage 编排与五路并行、多 Agent 容错、AI 产出多策略修复链(解析成功率 80%→99%+)、全链路 Trace 与两层评估。主张:AI 系统必须是白盒。
三、信号:把待测对象改造成可编程环境,提供编码反馈的环境层:对人是交付物,对 Agent 必须是环境。四个必要条件、6.4% 可执行率的连乘诊断、三层信号(单测/白盒/UI)、三个工程取舍(侵入边界、结构优先视觉兜底、会话解耦)、可测性治理与 L0→L5 成熟度阶梯。主张:自主性的地板是可测性。
四、合流:循环长度从 1 到 N,改变的是 Agent 能承担的任务类型;三个闭环证据 + 线上负向信号转回归用例的反向飞轮。
五、效果与代价:三端 100% 覆盖、单次分析 12 分钟、1.5w+ 入库用例、96% 操作成功率、性能报告 10 人日→1 人日;坦诚讲鸿蒙短板、运营成本与组织阻力。
六、总结收尾:更高的自主性来自更严的约束;质量工程师的价值转向设计判据、构建信号、改造环境。
实践痛点
演讲亮点
听众收益
适合听众
测试与质量效能负责人、研发效能与工程基础设施团队、移动端研发与架构、AI Agent 平台建设者。
预备知识
了解 LLM / Agent 基本概念,用过任一 AI Coding 工具(Cursor / Claude Code / Qoder)。
过去一年,AI Coding 已逐渐成为软件研发的新范式。随着代码生成能力不断提升,需求实现成本被大幅降低,研发生产节奏持续加快。然而,在真实复杂的工程环境中,研发效率的瓶颈正逐渐从“代码编写”转向“研发后链路”——包括稳定性分析、问题定位、风险治理、上线保障与经验沉淀等环节。这些工作仍然高度依赖人工,难以跟上 AI Coding 带来的研发吞吐增长,也成为 AI 深入研发流程必须解决的关键问题。
与此同时,鸿蒙生态快速发展,移动端研发正逐步进入 Android、iOS、HarmonyOS 多平台并行的新阶段。鸿蒙原生、KMP 等新技术栈在带来跨平台研发效率提升的同时,也引入了新的稳定性挑战:跨语言运行时、多技术栈协同、复杂异常现场分析等问题,使传统稳定性保障体系面临更高复杂度,也对 AI 的工程理解能力提出了更高要求。
本次分享将结合快手移动端稳定性 Agent「柯南 AI」的建设实践,分享 AI 如何从代码辅助走向研发后链路,成为能够理解工程上下文、参与稳定性治理的数字同事。内容将覆盖 Agent Workflow、Context Engineering、Agent Harness、Agent 友好型工程基建等关键实践,介绍 AI 如何自动完成异常现场聚合、证据补齐、根因分析、处置建议、自动修复及知识沉淀等完整流程,并结合鸿蒙与 KMP 等典型场景,分享 AI 在复杂工程环境下解决疑难稳定性问题的实践经验,探讨 Agent First 的稳定性研发新范式,以及 AI 驱动研发体系演进的未来方向。
演讲提纲
1. AI 时代移动端稳定性保障面临的新挑战
2. AI 如何重构稳定性研发流程:Agent First 工作范式
3. AI 驱动复杂稳定性问题治理实践
4. 总结与展望
实践痛点
大模型不是稳定性领域的银弹。一方面,稳定性天然和大量内部系统紧密结合,存在大量私域知识,而移动端线上版本的高度碎片化还会带来大量历史兼容性问题。这些信息无法通过模型升级被自然习得,而且还会被持续生产。我们需要持续通过上下文工程建设给模型补齐知识(私域知识),加上“手脚”(内部系统访问能力)。另一方面,一个稳定性问题被解决的上限,取决于问题现场的信息能多大程度被采集到。端侧基建不会过时,需要持续建设。
演讲亮点
实战参考价值:在快手这一亿级 DAU 和超长使用时长 App 上,在内部百级别开发者和真实线上 Top 问题的考验下取得实际提效和指标治理结果
听众收益
AI 大幅降低了代码生成成本,却没有同步降低正确性交付成本。进入大型工程后,模型更像一个能力放大器:工程基础扎实的地方被放大,缺失的约束、验证和定位能力也会被放大。
本次分享结合后端、Web 前端与移动端的真实实践,聚焦 AI Coding 落地最关键的四件事:约束、定位、验证、度量。分享如何将架构规则从文档变成可执行约束,利用工程关系精准定位上下文,通过自动化验证提供交付证据,并从“代码量、Token、采纳率”等过程指标回归到一个更核心的问题——AI 写出来的代码,我们敢不敢合并?
同时复盘大型团队在 AI 工程化过程中的真实取舍:哪些建设值得持续投入,哪些方案已经验证失败需要止损,以及什么样的工程与协作形态,才能真正支撑 Fullstack 的规模化 AI 交付。
演讲提纲
1. AI Coding 在大型工程中为什么容易失速
2. 把工程规则变成 AI 能理解的确定性约束
3. AI 时代工程能力的四个底座
4. 大型团队的真实实践与取舍
实践痛点
前沿亮点
听众收益
AI Coding 让代码生产速度大幅提升,但 Issue、PR、合规、安全等治理环节仍依赖人工,逐渐成为研发效率的新瓶颈。
本次分享将结合 Kimi Agent Harness 在开源场景的实践,介绍开源治理智能体 Mira 如何把 AI 从“发现问题”推进到“解决问题”:自动完成 Issue 分诊、PR Review、依赖与许可证扫描、安全漏洞响应,并通过渐进式授权、人机协同和全链路审计,让 Agent 真正进入生产治理流程。
分享将重点拆解从通用 Agent 到垂直治理 Agent 的工程实践,以及如何解决“敢不敢让 AI 动手”这一核心问题,并通过真实治理数据展示 Agent 对响应效率、维护者负担和治理质量的实际提升,探讨 AI Native 时代开源治理的新范式。
演讲提纲
1. 开源治理的新瓶颈
2. 从 Agent Harness 到 Mira
3. Mira 核心实践
4. AI 怎么做到“敢动手”
5. 真实数据与未来
前沿亮点
听众收益



微信咨询

电话咨询
领取往期热门演讲视频

