谷歌 15 亿美元抢购 AI 编程评测公司 Mechanize:继 Windsurf 之后,为 Gemini 补上最后一环
据 Business Insider 报道,谷歌正与旧金山 AI 编程评测初创公司 Mechanize 洽谈超 15 亿美元(约 102 亿元人民币)的非独家技术授权与人才引进交易。此前谷歌已花 24 亿美元拿下 Windsurf 团队,AI 编程赛道正进入「训练-评估-反馈」闭环竞争阶段。
核心结论
谷歌拟以超 15 亿美元获取 Mechanize 非独家技术授权并引进核心人才
继 24 亿美元收购 Windsurf 后,谷歌连续补强 Gemini 的编码与评估能力
AI 编程进入评估基建竞争,评估基础设施成为新护城河
国内团队应自建真实工程评估集,避免纯刷分基准
落地检查清单
交易概览:非独家授权 + 核心人才
据 Business Insider 8 月 5 日报道,谷歌正与 AI 编程评测初创公司 Mechanize 就一项价值超 15 亿美元(约合人民币 102 亿元)的交易进行谈判:以非独家技术许可方式获取 Mechanize 的 AI 编程评估技术,同时引进其核心人才从事模型评估与开发。Mechanize 成立于去年,团队规模不大,但技术定位精准——构建软件环境让 AI 代理执行真实工程任务并打分。
之所以是「授权 + 人才」而非全资收购,知情人士分析是为了规避反垄断审查并控制成本:Mechanize 若全资收购估值或达 20-30 亿美元。
为什么谷歌连续买 AI 编程资产
此前谷歌已花 24 亿美元拿下 Windsurf 团队。连续两笔交易背后是同一个逻辑:Gemini 的编码能力是谷歌相对落后的短板,而 AI 编程正是大模型最成熟的商业化场景——Gartner 估计 2025 年 AI 代码助手市场规模 30-35 亿美元,Cursor 2026 年 5 月 ARR 已飙至 40 亿美元,超 100 万付费用户,64% 的财富 500 强已部署。
Mechanize 的价值在于「评估闭环」:没有可靠的评估环境,就无法衡量模型改进、也无法训练 Agent 更好地完成任务。拿到 Mechanize 等于拿到衡量 AI 编程能力的一把尺子。
AI 编程赛道进入「闭环竞争」阶段
行业竞争已经从「谁的模型参数大」转向「训练-评估-反馈」闭环:微软(GitHub Copilot + OpenAI)靠生态领先,Anthropic(Claude Code)靠推理优势领先,谷歌起步最晚但资源最丰富。Mechanize 交易押注的是下半场——钱能买到人才和技术授权,但买不到时间,最终决定大模型时代定价权归属。
对开发者来说,这场竞争的直接受益是工具质量的快速提升:编码评估标准化后,IDE 内的 AI 助手会越来越「懂工程」,而不只是「会补全」。
对中国 AI 编程生态的启示
国内 AI 编程工具(如通义灵码、CodeGeeX、文心快码等)同样在拼编程基准与 Agent 能力,但「评估基础设施」仍是薄弱环节:缺少类似 Mechanize 的真实工程环境评测体系,各家基准成绩可比性有限。
建议国内团队建立自己的真实工程评估集:从开源仓库、企业内部代码中构建多语言、多框架的评测任务,用「能否独立完成一个真实 Issue」替代纯刷分基准,才能把 Agent 能力做实。
界面与截图

常见问题
Mechanize 是做什么的?
一家 AI 编程评测初创公司,构建软件环境让 AI 代理执行真实工程任务并评估其完成质量,成立于去年。
谷歌为什么不全资收购?
非独家授权 + 人才引进可规避反垄断审查并控制成本,全资收购估值可能达 20-30 亿美元。
这笔交易对开发者有什么影响?
编码评估标准化后,AI 编程助手会更懂工程任务;短期内 Gemini 编码能力有望提升。
交易完成了吗?
仍在洽谈中,细节可能变动,以谷歌官方公告为准。