DeepSeek斩杀线
现在的大模型价格,真的有点看不懂了。
2023年GPT-4刚开放API时,每百万输入token要30美元,输出更是60美元。那时候让模型写篇长文,都得先琢磨怎么把提示词压短一点,资料也不敢一次塞太多,用着用着还会去后台看看花了多少钱。
再看DeepSeek V4 Flash,未命中缓存的输入是每百万token 1元,输出2元,缓存命中后输入更是只要0.02元。按照这个价格,5000万缓存命中的输入只要1元,当然,新资料第一次输入还是要50元,不能把两个价格混在一起算。
但即便按正常价格来算,也已经便宜到让人敢放开用了。长篇小说、几十万字资料、代码仓库,过去得拆成很多段慢慢喂,现在直接整批处理,成本也没有那么吓人。
更关键的是,V4 Flash并没有为了低价把能力砍得只剩聊天。它支持100万token上下文,代码、推理和Agent任务的表现也在第一梯队附近。
我觉得这才是大模型真正开始普及的信号。以前大家比谁更聪明,现在还要比谁能让普通人和小团队用得起。