具身智能观察

阿里开源 Qwen3.8-27B 本地实测:性能很强,但 Agent 适配仍待补课

产业动态

来源:雷峰网发布时间待核实

从部署到实测:覆盖标准部署、量化部署、Agent场景三大维度。 作者丨吴海明 何宇轩 编辑丨李娜 岑峰 8月14日,阿里 Qwen 团队开源了 Qwen3.8-27B 模型,紧接着社区里的声音从“能不能跑”变成了“是不是新的模型斩杀线”,有人把它叫作本地 Opus,也有人直接给出更刺激的判断:一个 27B 开源模型,已经能在部分代码和 Agent 任务上达到顶级闭源模型的水平。那么,一个 27B 开源模型,体验到底怎么样呢? 根据官方数据,27B dense、Apache 2.0、262K 原生上下文、可扩展到 100 万 token、支持视觉理解、思考默认开启,低比特量化后还能压到十几 GB 级 GGUF 文件,这说明 Qwen3.8-27B 是一个试图把代码、长上下文、多模态和 Agent 工作流一起拉到本地的开源底座。 因此,我们从适配 Agent 出发,先后测试标准化部署、量化部署和接入 Agent 框架。其中,标准部署看 vLLM、SGLang 和 Llama.cpp 谁更能榨干 GPU,将推理速度提到最快;量化部署从 2bit 测到 16bit,看文件体积、速度和质量怎么取…

阿里开源 Qwen3.8-27B 本地实测:性能很强,但 Agent 适配仍待补课 | 具身智能观察