我们知道deepseek v4 flash的一大遗憾是它不是多模态的。这个项目可以让你在Codex 中使用该模型时,体验和用多模态模型差不多。(当然需要提供另一个能读图的模型api)地址:github.com/Anionex/codex-deepseek-vision
项目在 Codex 与原有 DeepSeek 上游之间插入 127.0.0.1:19100 代理;当用户贴图或 Codex 执行内置 view_image 后,代理识别请求中的图片,将图片并发发给一个 OpenAI 兼容的多模态视觉 API,得到详细文字描述后把图片内容替换成描述,再将改写后的请求转发给 DeepSeek,因此 DeepSeek 看起来就像具备了读图能力。How I AI

