Qwen 发布 Qwen3.8-27B:27B 参数的原生视音模组
Qwen 在 Hugging Face 发布了 Qwen3.8-27B 的模型权重与配置文件,定位为继 Qwen3.5/3.6 之后的更强一代。模型为 27B 参数的因果语言模型,带视觉编码器,原生支持图像与视频理解,默认启用“思考模式”,原生上下文长度 262,144,最高可扩展到 1,000,000。对开发者来说,Qwen3.8-27B 可在多种推理框架中部署,并提供官方云端托管与 API 支持,适合需要长上下文与多模态理解的场景。
Qwen 在 Hugging Face 上发布了 Qwen3.8-27B 的模型权重和配置文件,并指出这些制品兼容 Hugging Face Transformers、vLLM、SGLang、TokenSpeed 等工具。官方表示 Qwen3.8 是 Qwen 开源模型家族中能力最强的一代,Qwen3.8-27B 将这些能力以一个紧凑、便于部署的密集模型形式提供。
模型类型为带视觉编码器的因果语言模型(Causal Language Model with Vision Encoder),参数规模为 27B。核心能力包括改进的代码能力、专业工作与研究能力,以及面向长周期代理任务的增强执行能力。模型默认启用“思考模式”(thinking mode),会先产出以
Qwen3.8-27B 原生支持图像与视频理解,适用内容从 STEM 图示和文档到小时级视频。原生上下文长度为 262,144 token,并可扩展到 1,000,000 token。模型在架构层面给出了隐藏维度、注意力头数、FFN 中间维度等具体配置,并采用多步多 token 预测训练(MTP)。
官方推荐通过 API 使用 Qwen3.8,并建议在生产或高吞吐场景使用专用服务引擎(如 SGLang、vLLM、TokenSpeed)。文档还给出推荐的采样参数与不同 reasoning_effort 的用途说明,同时列出通过 Chat Completions API 调用模型的示例代码片段。官方并提到将提供由 Qwen Cloud 托管并具备更多生产特性的 hosted 版本,例如默认 1M 上下文长度与内置工具,托管服务将很快上线。
本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。