模型发布 / 更新普通
Qwen3.8-Flash-Next 获 vLLM 首发支持
原始标题:Amazing! 🥳 Thanks @vllm_project for getting Qwen3.8-Flash-Next running on NVIDIA and AMD from day 0…
内容摘要
通义千问 Qwen3.8-Flash-Next 获 vLLM 首发(day-0)支持,已在 NVIDIA 和 AMD GPU 上验证。该超稀疏多模态 MoE 模型拥有 125B 总参数、6B 激活参数、262K 原生上下文(经 YaRN 可扩展至 1M),并附带可卸载的 51B N-gram 表。模型现可通过 `vllm/vllm-openai:qwen38-flash-next` 镜像运行。
内容分类AI 模型发布与更新
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:通义千问 / Qwen (@Alibaba_Qwen)
站内情报编号intel-2117022347bddc3b9dbd1452