摘要

Alibaba 发布 Qwen3.8-27B 开源权重,这是 8 月 3 日 Qwen3.8-Max 发布时承诺的 Qwen3.8 家族开源版本。它是一个 27.8B 稠密视觉语言模型,采用混合注意力(Gated DeltaNet + Gated Attention),支持图像、视频、文本输入,协议为 Apache 2.0。原生上下文 262,144 token,可通过 YaRN 扩展到 1M。默认开启 thinking,可用 reasoning_effort 调节(xhigh/medium/low)。

为什么重要
对要给本地或自托管 coding agent 选基座模型的人来说,这是本周期的头号候选:单卡就能跑的开源模型,给出了接近前沿水平的 agent 和多模态能力,还是 Apache 2.0 协议。
技术细节
参数量 27.78B BF16(约 55.6GB)
架构 64 层;16 ×(3 ×(Gated DeltaNet → FFN)→ 1 ×(Gated Attention → FFN));MTP 训练;架构族 qwen3_5
上下文 原生 262,144 / YaRN 扩展 1,000,000
模态 image-text-to-text(图片、视频、文本)
许可证 Apache-2.0
Benchmarks
swe_bench_pro 61.7 terminal_bench_2_1 73 livecodebench_v6 90.3 gpqa_diamond 89.2 osworld_verified 84.3 webarena_verified 64.8 deepswe_1_1 42.2 hle 30.8 ifbench 79.5
采用情况 发布约 1 天内在 HF 获 91,917 次下载、9,479 个赞;319 个社区量化版;Ollama 当天即支持(8/14 v0.32.12/v0.32.13);OpenRouter 每 Mtok $0.45/$3.20
运行时 vLLM · SGLang · transformers · Ollama
标签
qwenopen-weightsapache-2agenticmultimodallong-contextlocal