印度韩国突然宣称有媲美DeepSeek大模型
现在大模型圈有个挺有意思的现象,只要发布一款新模型,发布会上先把媲美DeepSeek打出来再说。
印度Sarvam说自家的105B模型能以更低算力达到接近DeepSeek的水平,韩国SKT也说A.X K1在部分数学和编程测试里可以比肩甚至超过DeepSeek-V3.1。听起来确实挺猛,但仔细看,基本都加了特定测试、部分能力这些前提。
所以先别急着封神。大模型真正好不好用,不是发布会挑几张成绩表就能说明的,还得看权重和技术细节是否公开、第三方能不能复现、实际用户用起来到底怎么样。
DeepSeek当初能引起这么大关注,也不只是因为跑分高,而是性能、成本、开源和实际使用效果一起摆在了大家面前。印度和韩国的新模型有进步当然值得看,但媲美这两个字,还是等开发者真正用过之后再下结论吧。