Qwen3.8 27B 开源小模型以 52 分追平 DeepSeek V4 Flash

阿里通义千问发布的 Qwen3.8 27B(Apache 2.0 开源)在 Artificial Analysis 智能指数上获得 52 分,是同类 4B–40B 小模型中的最高分,追平了位列大模型组第五的 DeepSeek V4 Flash 0731,也超过了此前小模型组榜首 Qwen3.6 27B 的 38 分。该模型支持文本与图像输入、256K 上下文窗口;社区实测显示,它在较高推理档位下表现出极强的智能体倾向——目标追踪与工具调用稳定,甚至会执着地尝试非常规手段解决问题。

对开发者而言更关键的是落地成本:27B 权重意味着单张消费级显卡即可运行,社区反馈“在游戏 PC 上跑得很流畅”。此前属于云端大模型的智能体能力,正在进入本地硬件可负担的范围。

这个成绩也把模型经济的争论推到台前:当 27B 开源模型在基准上追平规模大得多的闭源前沿时,巨型数据中心与高昂推理成本的故事需要重新论证。开源小模型正在成为智能体应用兼顾性价比与可控性的现实选择,而这恰恰是 Agent 经济大规模落地的前提。

阅读原文