12G显存部署125B Qwen3.8-Flash-Next 全攻略
@MinLiBuilds · 2026-10-08 08:14
Qwen3.8-Flash-Next,核心模型 125B 参数,每个 token 激活约 6B,智力与Opus4.6持平。 部署到12GB 显卡,接近 100 tok/s,甚至比 Astra 还快2倍? 使用Strata,大力出奇迹,让 GPU、CPU、RAM 和 SSD 一起干活。
曝光 50547 · 评论 55 · 点赞 270 · 书签 393
@MinLiBuilds · 2026-10-08 08:14
Qwen3.8-Flash-Next,核心模型 125B 参数,每个 token 激活约 6B,智力与Opus4.6持平。 部署到12GB 显卡,接近 100 tok/s,甚至比 Astra 还快2倍? 使用Strata,大力出奇迹,让 GPU、CPU、RAM 和 SSD 一起干活。
曝光 50547 · 评论 55 · 点赞 270 · 书签 393