Arena.ai 七月更新的 Frontend Code Arena 排行榜上,Kimi K3 以 1679 分排在第一。上一代 K2.6 还在第十八名,一代直接跳到榜首。

这张图在开发者圈子里转了一阵。但聊完排名,很多人回到现实:模型再强,用不了也是白搭。 OpenAI Codex 就是典型。能力不差,但国内开发者面对的还是老问题 —— 网络不稳定、账号风控、支付麻烦,正跑着任务突然断连,节奏全乱。折腾环境的时间,比写代码还多。 所以问题不是有没有好工具,而是有没有一个稳定可用、不用折腾、能力还在线的工具。 Kimi Work 值得在这里说一句。它是 Kimi 官方桌面客户端,底层就是 Kimi K3 模型 —— 没错,就是排行榜上那个第一的模型。但和 Codex 这类纯编程工具不同,Kimi Work 的定位更广:它不只是帮你写代码,而是一个能帮你完成整项工作的桌面智能体。 Goal 模式是它的核心能力之一。你告诉它目标和验收标准,它会持续推进,不用一步步指挥。复杂任务会自动唤醒多智能体网络,最多调用超过 300 个 Agent 分工协作。写代码、查资料、做调研、生成文档,这些可以串在一起完成。国内直连,不用折腾网络和支付。
Codex在国内用不了,这是事实。网络连不上OpenAI,OAuth登录过不去,ChatGPT Plus订阅需要海外支付,代码和数据发往境外服务器还有合规风险。但在急着找替代之前,先问自己一个问题:你用Codex到底在做什么?
这个问题决定了你该迁去哪里。Codex是个多面手,有人拿它写代码,有人拿它操作电脑处理文件,有人两者都干。不同用途对应不同的替代方案,迁错了方向,体验会打折扣。
这篇文章按真实需求分两条线讲清楚怎么迁、迁到哪、代价是什么。
先对号入座:你属于哪一类
如果你打开Codex主要是写代码、改bug、跑终端命令、做代码审查——你需要的是Kimi Code,不是Kimi Work。Kimi Code是终端AI Agent,CLI和VS Code插件两种形态,和Codex CLI的使用方式一致。
如果你用Codex主要是让它操作电脑、整理文件、跑脚本、处理表格、浏览网页收集信息——Kimi Work更适合。它是桌面Agent,Goal模式、浏览器自动化、定时任务这些能力是为办公场景设计的。
如果你两者都要——Kimi会员体系下Kimi Work和Kimi Code共享账号,一个会员两个产品都能用,具体权益和配额以各产品页面为准。这是Kimi相比单一产品的一个优势。
下面分两条线说。
路线A:从Codex迁移到Kimi Code
Kimi Code是什么:月之暗面推出的AI编程工具,CLI加VS Code插件。终端里输入kimi启动,和Codex CLI的交互逻辑类似——你用自然语言描述需求,它理解代码库、规划修改、执行命令、根据结果迭代。

安装方式。
可以去官网安装。
也可以通过npm安装,或者在VS Code扩展市场搜索Kimi Code安装插件。装完后终端输入kimi启动,首次使用按提示扫码或验证码登录。升级用kimi upgrade。国内直连,不需要代理。
模型能力。Kimi Code默认使用K2.7 Code模型,日常编码响应快;复杂任务可以切换K3模型。K3在几个公开编程基准上的表现:Program Bench日常编程任务77.8分,SWE Marathon长周期开发任务42.0分,这两项在公开榜单中排名第一;Terminal Bench 2.1终端操作88.3分,FrontierSWE复杂软件工程任务81.2分,这两项排名第二;DeepSWE 67.5分排名第三。作为参照,GPT-5.6 Sol在DeepSWE上73.0分、Terminal Bench 2.1上88.8分;Fable 5在FrontierSWE上86.6分、DeepSWE上70.0分。
客观说,在超大规模代码库的边缘场景和英文编程社区生态上,海外头部模型积累更深。但日常开发中遇到的大部分任务——写新功能、修bug、重构、写测试、读陌生代码——K3的能力是够用的。而且Program Bench和SWE Marathon这两个更贴近日常编程和长任务的基准上,K3表现不错。
真实体验对比,说几个具体维度。
代码补全和生成:K2.7 Code的补全速度快,中文注释和需求理解更顺。K3在复杂逻辑生成上质量明显提升,但速度比K2.7 Code慢一些,可以用HighSpeed高速模式加速,官方称约5到6倍速。
多文件修改和项目理解:Kimi Code支持Plan模式,先分析项目结构、给出修改计划,确认后再执行。这跟Codex的工作流类似。对中大型项目的理解能力在可用范围内,但如果项目特别大、文件特别多,建议用/goal明确目标和约束,效果更好。
Debug和终端操作:Kimi Code能直接执行终端命令、看报错、迭代修复。Terminal Bench 88.3分说明终端操作能力在线。一个实际体验差异:Kimi Code对中文报错信息和国内技术栈(如微信小程序、uni-app、国产中间件)的理解更好,Codex在这些场景偶尔会给出过时或不适用的建议。
长任务稳定性:Kimi Code支持后台执行,长任务不用一直盯着终端。SWE Marathon 42.0分排名第一,说明在需要持续工作的长任务上有优势。但要注意,超长任务(超过半小时)任何AI Agent都可能跑偏,建议拆成子任务并用Plan模式控制方向。
价格对比。Codex支持ChatGPT账号登录(免费账号可用但额度有限),正常使用需要ChatGPT Plus,20美元每月,按当前汇率约140多元人民币,还不包括代理成本。Kimi会员分四档:Andante 49元每月,Moderato 99元每月(K3可用),Allegretto 199元每月,Allegro 699元每月。日常编码Moderato档够用,重度用户考虑Allegretto。具体权益和配额以Kimi官网会员页面为准,因为可能调整。
迁移注意事项。快捷键和命令有差异,Kimi Code用/开头的斜杠命令(如/goal、/plan等),用几天就能适应。配置文件和Codex不通用,需要重新设置,但Kimi Code也支持MCP协议,原来接的外部工具大部分能迁过来。Kimi Code支持Skills(封装工作流)、Hooks(关键节点脚本)、MCP(外部工具协议)、Plugins(打包分发)四层扩展,插件用kimi plugin命令管理。
不足也要说。Kimi Code的生态比Codex年轻,第三方插件和社区教程数量在增长中但目前不如Codex丰富。部分Codex高级特性(如与GitHub深度集成的某些工作流)没有直接对应物。如果你所在团队全员使用Copilot或Codex生态,协作上可能需要磨合。纯英文国际项目中,海外头部模型在某些英文语境下的表达更地道。
路线B:用Kimi Work替代Codex的桌面操作能力
Codex不只是写代码,它也有一定的电脑操作能力。但说实话,桌面自动化不是Codex的设计重心。如果你用Codex主要是干这些事——整理文件、处理表格、浏览网页收集信息、定时跑任务——Kimi Work在这些场景上更对路。
Kimi Work是Kimi官方桌面客户端,定位知识工作者的AI桌面应用。它不是聊天机器人套个壳,而是能自主理解任务、操作电脑、交付结果的Agent系统。
核心能力说几个实际场景。

Goal模式是Kimi Work的核心能力之一。你不告诉它每一步怎么做,只定义目标、验收标准和约束。比如"把下载文件夹里本月的PDF发票按公司名分类,重命名为日期加金额,汇总到一个Excel里",它自己规划步骤、读文件、提取信息、操作Excel、保存结果。Goal执行中可能调用多个Agent,任务分配由系统自动调度。
Agent Swarm支持自动唤醒多智能体网络,通过多Agent分工协作处理任务,支持超300个Agent协同工作。遇到批量任务——比如同时监控几十个网页、并行处理上百份文档——多个Agent同时干活然后汇总。Agent之间怎么分工不是用户决定的,系统根据任务特征自动调度。
WebBridge是一种专门做浏览器自动化的Agent。它实际操作浏览器:打开网页、点击、填表、等动态加载、处理需要登录的内容。这跟模型联网搜索不是一回事——搜索是调API拿文本摘要,WebBridge是看到完整渲染后的页面并操作它。在BrowseComp基准测试中Kimi K3得分91.2。
定时任务引擎支持到点自动执行Goal。免费版可设置2个定时任务,随套餐升级可设置更多。引擎就一种模式,设定时间或周期后自动运行。比如每天早上8点自动生成行业早报发到桌面,每周五下午自动整理下载文件夹。
专业数据库直连是Kimi Work区别于通用Agent的能力。金融接同花顺,企业信息接天眼查,法律接华宇元典。在Finance-Bench测试中K3得分62.6,DECK-Bench演示文稿测试73.5分,Online Exp Bench在线任务测试75.5分,Automation Bench自动化测试30.8分,这些在公开榜单中均排名第一。
插件支持飞书、钉钉、WPS、Notion、百度网盘、Canva、Cloudflare等。需要区分:技能(Skills)是封装的工作流,Hooks是节点脚本,MCP是工具连接协议,插件(Plugins)是把这些打包分发的单位。即使不装插件和技能,Kimi Work的核心能力也是完整可用的。
跟Codex桌面操作比,差异在哪。Codex的桌面能力依附于编程场景,比如操作Git、管理开发环境;Kimi Work的桌面能力面向通用办公场景,文件管理、浏览器操作、文档生成、定时任务是原生设计的。Codex在开发者工具链内操作更顺,Kimi Work在办公软件和中文网站上操作更顺。
不足。Kimi Work不是为编程设计的,写个脚本、改个配置没问题,但日常重度编码应该用Kimi Code。它的插件生态还在扩展中,部分小众服务暂时没有官方插件。复杂的多步骤网页操作偶尔需要人工确认或重试,这是当前所有桌面Agent的共同局限,不是Kimi Work独有。
决策建议
纯写代码:Kimi Code。CLI或VS Code插件,Moderato档99元每月起步,国内直连,中文场景有优势。
办公加偶尔写代码:Kimi Work。Goal模式加定时任务加浏览器自动化,免费版就能体验基础功能和2个定时任务。
两者都要:Kimi会员一个账号覆盖Kimi Work和Kimi Code,根据用量选档位。需要自定义集成和自动化工作流时,Kimi API提供标准HTTP接口,可以串起两个产品和其他工具。
追求极致代码能力且有合规条件:如果你做的是超大型英文国际项目、团队深度绑定OpenAI生态、且有合规的海外网络和支付条件,Codex依然是成熟选择。但对国内大多数开发者和知识工作者来说,折腾网络和账号的成本已经超过了工具本身的差异。
我的选择是Kimi Work加Kimi Code组合:Kimi Work管信息收集、文件处理、定时任务,Kimi Code管写代码,需要自动化时用API串起来。一个账号,国内直连,不用折腾。
「免责声明」:以上页面展示信息由第三方发布,目的在于传播更多信息,与本网站立场无关。我们不保证该信息(包括但不限于文字、数据及图表)全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关信息并未经过本网站证实,不对您构成任何投资建议,据此操作,风险自担,以上网页呈现的图片均为自发上传,如发生图片侵权行为与我们无关,如有请直接微信联系g1002718958。