DeepSeek V4 Flash 正式版发了。
不是Preview,是正式版。Terminal-Bench跑到82.7,工具调用能力直接起飞。
但最让我兴奋的不是跑分,是这句话:
原生支持Codex。
什么意思?
你不用花一分钱订阅,就能用上现在最主流的AI编程Agent。一条命令,接入完成。
而且今天我还教你一个骚操作:给DeepSeek装个"眼睛",让它在Codex里也能识图。
全程实操,照着做就行。
🚀 第一步:下载Codex
在微软商店搜"ChatGPT"或者"Codex"。
现在这俩合并了,是同一个程序。下载安装,打开一次。
它会让你登录,
不用管,先别登
。我们等会儿用DeepSeek接管它。
🔑 第二步:拿DeepSeek API Key
去DeepSeek开放平台。直接搜"DeepSeek开放平台"就能进。
进来找到API Keys页面,点"新建"。
名字写个"Codex"方便自己认,创建完把Key复制下来。
注意:它只显示一次,存好。
如果之前没充过值,微信支付宝充个十块钱就够用很久了。V4 Flash的价格极其便宜。
⚡ 第三步:一键脚本接入
这步是核心。
DeepSeek官方出了一键接入脚本,专门给Codex适配的。
打开PowerShell,
以管理员身份运行
把官方脚本命令粘进去,回车。
它会问你:选V4 Flash正式版还是其他?
选1,V4 Flash正式版。
然后输入你刚才的API Key。
搞定。一条命令,接入完成。
不用CC Switch,不用手动改配置文件,不用折腾任何东西。
✅ 第四步:验证成功
关掉Codex,重新打开。
Mac端模型选择器中显示「自定义」即为生效;Windows端可能显示「自定义」或「DeepSeek-V4-Flash」。显示为「自定义」时,实际使用的就是你选择的DeepSeek模型。
随便问一句:"你好,你是什么模型?"
它回答你了,就说明DeepSeek已经接管了Codex。
你现在拥有了一个完全免费的、跑着DeepSeek V4 Flash正式版的AI编程Agent。
😵 问题来了:它看不了图
DeepSeek V4 Flash目前没有多模态能力。
说人话就是:你给它截个图,它不知道那是什么。会尝试调用各种工具去读,但就是看不懂图片内容。
编程的时候这其实挺致命的。比如你想让它看一下报错截图、UI设计稿、或者一个流程图,它全都抓瞎。
怎么办?
给它装个"眼睛"。
👁️ 第五步:安装Claude Vision Skill
GitHub上有一个开源项目,叫
Claude Vision Skill
别被名字骗了。虽然叫Claude,但它的作用就是给所有没有视觉能力的模型补上看图功能。在Codex里一样能用。
操作极其简单:在Codex里开个新会话,直接说"帮我安装这个Skill",把GitHub项目地址丢给它。
它会自动下载、配置、装好。你什么都不用管。
🎯 第六步:配置识图模型(重点来了)
Skill装好之后,它需要一个能看图的模型来当"眼睛"。
这里我跟别人的教程不一样。
它默认推荐用阿里千问。但我用的是我在小龙虾上面已经配好的多模态模型。
为什么?
两个原因:
第一,资源不浪费。
你如果已经在小龙虾上配了一个比较完整的多模态模型,比如一个TokenPlan,那就直接用上!不用再另外去申请千问的Key,不用再多开一个平台。
第二,额度充分利用。
小龙虾上的额度不一定每次都跑得完,对吧?那正好,把一部分用量分配到Codex的识图上来。DeepSeek缺什么,你就拿小龙虾上的多模态去补。
一个补短板,一个消库存。完美。
配置方式:把你小龙虾的API地址和Key填进去,模型名字选你那个多模态的,搞定。
当然,如果你没有小龙虾,也可以用阿里云百炼。新用户有100万免费Token,够你识图用很久了。
🎉 第七步:验证识图
开个新会话。
随便截个图丢进去,就问一句:"这是什么?"
你会看到它自动调用了Vision Skill,去读图了。
识别成功?全通了。
现在你手上是什么东西?
一个不用花订阅费、跑着DeepSeek V4 Flash正式版、还能看图的Codex。
✍️ 最后总结
今天就会了两件事:
第一,用官方一键脚本把DeepSeek接入Codex。
一条命令,不折腾。
第二,用GitHub上的Claude Vision Skill补上识图。
配上你手上已有的多模态模型,资源不浪费。
这个组合的核心逻辑是:
用最低成本,拼出一个功能完整的AI编程Agent。
DeepSeek负责代码和文本,小龙虾的多模态负责看图。各司其职,互相补位。
工具这东西,不是越贵越好,是越会组合越强。
所有链接和脚本我放评论区,自取。
觉得有用,转发给你身边也在用AI写代码的朋友。
📝 本文约1200字,预计阅读4分钟
