那一天,cn 2条巨龙同时睁开双眼,颤抖吧
今天 一大早给openrouter 的ox模型刷屏
从昨天到hy4,猜到mimo,最后好像给实锤glm多模态了
我只能说99.9%是,剩下0.1 交给下周开盒就好了
原生支持文本-图像-视频
但是速度慢是真的慢
按glm 5v的趋势,开源的概率大概就6成了
5.3是5.2后训练出来的
那这次的多模态也应该是base 5.2的基础上完成多模态的支持和实现(当然,前提它是glm)
在zcode上的表现目前算80分吧,中上,并发和速度是最大的瓶颈
对图像的理解,图像文本识别之类都挺好的,对齐opus5应该没什么大的问题
然后是昨晚dsh 适配多模态,下午模型api就支持上了新模型
这个模型更像在原本的flash基础上,增加视觉模块的后训练(200+b,训的也快)
对图像的细节和理解也挺到位,官方数据主打追着opus4.8锤
价格对齐flash,一个图像注定了压缩后的token(经典resize)
那么,这次又是谁锤谁呢?
上一次是deepseek发布v4pro后glm跟进5.3
这次glm提前预览多模态,依旧给ds直接发布[呃R]
牢梁,我感觉你在做智谱股票的t但我没证据
safphere AI反常识howto DeepSeek多模态正式发布 glm多模态 hy4 AI搞学习howto

