当前位置:首页 > 报告详情

腾讯研究院:2026丰饶之后:AI Coding 观察报告 2.0(41页).pdf

上传人: b**** 编号:1235781 2026-05-12 41页 9.09MB

下载:

1、VOL.02 2026TENCENT R ESEAR CH IN STI TUTE AI LENSAI CODING 2.0丰饶之后AI Coding 观察报告 2.02025H2 2026Q1腾讯研究院AI 透镜系列研究2026 年 4 CONTENTS目录开篇:9 个月后回望第一版 7 非共识验证 本版 6 个洞察速览301质变时刻两道能力门槛 五维证据 METR 逆转602模型与驾驭工程趋同与分化 驾驭工程 协同进化1003工具生态的重塑Agent-First CLI vs MCP Skills1604当构建不再稀缺瓶颈迁移 原型墙 赛道消融2105格局与安全SaaS 重新分配 三种新攻

2、击面 攻防对称2706面向未来角色转型 非开发者入场 就业流动 展望33附录验证对照表 关键时间线 术语表 参考文献38目录2PROLOGUE开篇:9 个月后回望From seven non-consensus questions to six structural insights.2025 年 7 月,腾讯研究院发布第一版AI Coding 非共识报告,提出 7 个行业非共识,判断“AICoding 是通用 Agent 的先验战场”,将“从 2,500 万开发者走向数十亿构建者”作为愿景。9 个月后,这 7 条非共识的验证情况如下。01产品形态:本地 vs 云端 三极并存:CLI/IDE/

3、Cloud一版没有简单站队,而是用“本地云端/交互辅助自主执行”四象限切分出 IDE/插件、CLI、VibeCoding、异步 Coding Agent 四类,并把 CLI 单独称为“进可攻退可守的通用潜力股”。9 个月后,这个判断兑现方式超预期:CLI 不只是通用,而是全面赢得开发者内循环(Claude Code 8 个月成为最受使用和喜爱的工具);IDE 继续在专业场景坚守并 Agent 化(Cursor 3、Google Antigravity、VSCode Multi-Agent);Vibe Coding 产品向设计等通用场景迁移;云端异步 Agent 则在“龙虾热”下将 IM 变为交

4、互入口。四象限结构仍然成立,重心向 CLI 与异步侧迁移。02模型选择:自研 vs 第三方 模型选择:趋同与分化一版的“自研+第三方”四象限仍是理解模型策略的基本框架,指出“多模型策略+智能路由”正在成为主流。9 个月后,原问题“该选哪家模型”已被更深层问题取代:六大商业模型 SWE-bench Veri?ed 压缩到 1个百分点区间内,开源 Qwen3-Coder 追至 80%段位。但 Anthropic 2026.4 同时发布 Mythos Preview(93.9%,不公开)与 Opus 4.7(87.6%,公开)的双轨机制表明,前沿实验室的能力储备与已公开模型之间正在拉开新的差距。03

5、用户价值:提效 vs 降效 已跨越争议期一版在这条上最审慎:同时摆出吴恩达“效率提升至少 10 倍”和 METR 随机对照实验“AI 让开发者慢了19%”,让争议成为真正的非共识。9 个月后,METR 同批参与者在 2026.2 的后续实验中逆转为快 18%(CI-38%到+9%),30-50%开发者拒绝“无 AI”条件。争议期已跨越,但一版埋下的测量论(“自我报告的时间节省与 PR 吞吐量指标之间存在脱节”)在 V2 谈 AI 生产力时仍然值得引用。开篇:9 个月后回望304付费模式:固定 vs 按需 按需/信制成为主流一版已明确判断“混合模式 38%超过订阅/席位制 36%成为最主流”,指

6、出“传统 SaaS 的固定订阅模式在AI 高变动成本下出现结构性问题”。这条验证最彻底:所有主流产品(Cursor/Claude Code/Copilot/Devin/Replit Agent)都走向 Token/Credit/ACU(Agent Compute Unit)等抽象计费单元的按需或混合制。一个延伸判断:AI 的成本倒逼驾驭工程,每次 Agent 失败都是直接成本,这成为企业投资驾驭框架的直接商业理由。05企业态度:激进 vs 渐进 两极分化加剧一版用“从强制使用到进入绩效”描述激进派路径,摆出 Dario Amodei“3-6 个月内 AI 写 90%代码”的最激进预测。9 个月

word格式文档无特别注明外均可编辑修改,预览文件经过压缩,下载原文更清晰!
三个皮匠报告文库所有资源均是客户上传分享,仅供网友学习交流,未经上传用户书面授权,请勿作商用。
1. **模型趋同与前沿分化**:六大商业模型SWE-bench Verified压缩至1%区间,但Anthropic双轨发布(Mythos Preview 93.9%不公开,Opus 4.7 87.6%公开)拉大前沿差距。 2. **Agent原生生态**:工具形态向Agent-First(Cursor 3、Codex App)收敛,接口分层(CLI赢内循环、Skills补齐非开发者层)。 3. **瓶颈迁移**:代码生成规模化(Opus 4.7 SWE-bench 87.6%),新瓶颈在验证(Veracode 45% AI代码含漏洞)与规格定义。 4. **SaaS重新分配**:中间层SaaS受冲击(Figma -6.89%),Cursor估值跃至$500B,Skills生态目录季度翻倍。 5. **攻防对称下降**:AI降低攻防门槛(Carlini用Claude发现Linux内核23年漏洞),OAuth权限面扩大。 6. **开发者双向重定义**:角色从编写者转向编排者(Staff+工程师63.5%重度用户),非开发者通过Skills入场(10分钟写Agent能力)。
AI 编程新瓶颈? 开发者会被取代? SaaS 真的死了?
客服
商务合作
小程序
服务号
折叠