1、VOL.02 2026TENCENT R ESEAR CH IN STI TUTE AI LENSAI CODING 2.0丰饶之后AI Coding 观察报告 2.02025H2 2026Q1腾讯研究院AI 透镜系列研究2026 年 4 CONTENTS目录开篇:9 个月后回望第一版 7 非共识验证 本版 6 个洞察速览301质变时刻两道能力门槛 五维证据 METR 逆转602模型与驾驭工程趋同与分化 驾驭工程 协同进化1003工具生态的重塑Agent-First CLI vs MCP Skills1604当构建不再稀缺瓶颈迁移 原型墙 赛道消融2105格局与安全SaaS 重新分配 三种新攻
2、击面 攻防对称2706面向未来角色转型 非开发者入场 就业流动 展望33附录验证对照表 关键时间线 术语表 参考文献38目录2PROLOGUE开篇:9 个月后回望From seven non-consensus questions to six structural insights.2025 年 7 月,腾讯研究院发布第一版AI Coding 非共识报告,提出 7 个行业非共识,判断“AICoding 是通用 Agent 的先验战场”,将“从 2,500 万开发者走向数十亿构建者”作为愿景。9 个月后,这 7 条非共识的验证情况如下。01产品形态:本地 vs 云端 三极并存:CLI/IDE/
3、Cloud一版没有简单站队,而是用“本地云端/交互辅助自主执行”四象限切分出 IDE/插件、CLI、VibeCoding、异步 Coding Agent 四类,并把 CLI 单独称为“进可攻退可守的通用潜力股”。9 个月后,这个判断兑现方式超预期:CLI 不只是通用,而是全面赢得开发者内循环(Claude Code 8 个月成为最受使用和喜爱的工具);IDE 继续在专业场景坚守并 Agent 化(Cursor 3、Google Antigravity、VSCode Multi-Agent);Vibe Coding 产品向设计等通用场景迁移;云端异步 Agent 则在“龙虾热”下将 IM 变为交
4、互入口。四象限结构仍然成立,重心向 CLI 与异步侧迁移。02模型选择:自研 vs 第三方 模型选择:趋同与分化一版的“自研+第三方”四象限仍是理解模型策略的基本框架,指出“多模型策略+智能路由”正在成为主流。9 个月后,原问题“该选哪家模型”已被更深层问题取代:六大商业模型 SWE-bench Veri?ed 压缩到 1个百分点区间内,开源 Qwen3-Coder 追至 80%段位。但 Anthropic 2026.4 同时发布 Mythos Preview(93.9%,不公开)与 Opus 4.7(87.6%,公开)的双轨机制表明,前沿实验室的能力储备与已公开模型之间正在拉开新的差距。03
5、用户价值:提效 vs 降效 已跨越争议期一版在这条上最审慎:同时摆出吴恩达“效率提升至少 10 倍”和 METR 随机对照实验“AI 让开发者慢了19%”,让争议成为真正的非共识。9 个月后,METR 同批参与者在 2026.2 的后续实验中逆转为快 18%(CI-38%到+9%),30-50%开发者拒绝“无 AI”条件。争议期已跨越,但一版埋下的测量论(“自我报告的时间节省与 PR 吞吐量指标之间存在脱节”)在 V2 谈 AI 生产力时仍然值得引用。开篇:9 个月后回望304付费模式:固定 vs 按需 按需/信制成为主流一版已明确判断“混合模式 38%超过订阅/席位制 36%成为最主流”,指
6、出“传统 SaaS 的固定订阅模式在AI 高变动成本下出现结构性问题”。这条验证最彻底:所有主流产品(Cursor/Claude Code/Copilot/Devin/Replit Agent)都走向 Token/Credit/ACU(Agent Compute Unit)等抽象计费单元的按需或混合制。一个延伸判断:AI 的成本倒逼驾驭工程,每次 Agent 失败都是直接成本,这成为企业投资驾驭框架的直接商业理由。05企业态度:激进 vs 渐进 两极分化加剧一版用“从强制使用到进入绩效”描述激进派路径,摆出 Dario Amodei“3-6 个月内 AI 写 90%代码”的最激进预测。9 个月