2.4T 参数的国产旗舰 Qwen3.8-Max,刚开源权重就被放到海外平台 Nebius Token Factory 做 Day 0 首发推理。不用自己堆卡、不用搭集群,云端第一天就能用上它的“专属算力”版本。
两边账号几乎同步官宣:阿里云 @alibaba_cloud 8 月 14 日喊出“Big model, right from the start”并@nebiustf;Nebius @nebiustf 在 8 月 12 日就把 Qwen3.8-2.4T-A95B 摆出来,自称“Day 0 launch partner”,强调“going open weight”。叠在一起就是一个信号——Qwen 把开源权重和商用托管两条线,同时抢首发窗口。
对开发者更关键的是,Nebius 给的是 Managed Services 形式的 dedicated inference,即专用推理,不是大家抢的共享 API。它对应独占算力池,瞄准在意延迟、稳定性和数据隔离的企业级需求。如果国内推理资源不够用、或想绕开自建集群的运维,这条新通道直接接上一个海外专用机房。
门槛还在。原帖没披露价格、可用区域、上线时间点,也没说上下文窗口、配额这些边界;Qwen3.8-Max 和 2.4T-A95B 是不是同款 SKU,材料里也没讲死。能跑、能省心,能不能跑得起、跑得长久,还得等官方补齐数字。
我的判断:这事看点不是“多了一个 API”,而是国产顶配模型第一次在海外拿到 Day 0 级的专用推理托管,是商业化路径的一次明显外延。你最想拿 Qwen3.8-Max 跑哪类活儿?

