昊梵体育网

破烂显卡部署Qwen3.8实现token自由

这个模型是越狱版本的,懂得都懂。
27b跑在2张3090,开启MTP之后,每秒可以达到68的token输出。相当的可用。
图三是把本地模型接入到codex中一分钟生成的项目的架构图,既快又狠#codex#claude #ai模型