gpt-5.6-luna 降价80%之后的 DeepSWE (大模型编程能力的基准评价测试)每任务成本(美元)对比,太吓人了,这不单单是冲着 DeepSeek-V4-pro来的,而且冲着 GLM-5.2 、 Grok 4.5 和 Kimi-K3 一起打。

gpt-5.6-luna 降价80%之后的 DeepSWE (大模型编程能力的基准评价测试)每任务成本(美元)对比,太吓人了,这不单单是冲着 DeepSeek-V4-pro来的,而且冲着 GLM-5.2 、 Grok 4.5 和 Kimi-K3 一起打。
