昊梵体育网

用了半年豆包才咂摸出味儿——它背后的字节,正闷头练一个10万亿参数的大模型。

用了半年豆包才咂摸出味儿——它背后的字节,正闷头练一个10万亿参数的大模型。

这数有多夸张?差不多是Kimi K3的三倍多,量级冲到全球第一梯队。但它偏不抄近路:同行靠“蒸馏”拿别人模型的输出快速追,字节自己把这条捷径堵了,张一鸣的原话是“为长期目标,牺牲点短期利益也行”。

我倒觉得这跟你我不是没关系。你每天喂给豆包、即梦的问题和图,就是它练级的免费教材;模型越大越吞数据。可反过来看,它真练出来,你手里的AI是不是能少点“听不懂人话”的尴尬。

国产大模型卷到10万亿,你手机里那几个AI App,哪个因为模型升级明显变聪明过?报报,我攒一份“谁在真进步”清单。人工智能