返回首页
[ 头条新闻 ] 2026-08-18 10:22

Qwen3.8-27B开源即爆火:多模态性能超越Claude,解码速度达76 token/s

Qwen3.8-27B开源即爆火:多模态性能超越Claude,解码速度达76 token/s

一、性能硬刚Claude,27B参数凭什么?

很多人一看“27B”,可能觉得也就是个中端模型。但Qwen3.8-27B在好几个基准测试上的成绩,比Claude Opus 4.6 Max还高。编程和软件工程、智能体任务、竞争性编程、指令遵循,这几个领域它都拿了领先分数。而且它原生支持图像和视频理解,不靠外挂视觉模型,是真·多模态。

  • 编程与软件工程:超过Claude Opus 4.6 Max
  • 智能体任务:计算机操作、移动端操作均领先
  • 多模态软件工程:得分高于Claude Opus 4.6 Max
  • 上下文长度:262K原生,YaRN扩展到100万token

二、架构和推理:混合注意力+MTP加速

Qwen3.8-27B用的是三层Gated DeltaNet加一层Gated Attention,这个组合重复16次,其中四分之三是线性注意力,四分之一是完整注意力。这种混合架构在保证效果的同时,大幅降低了计算复杂度。

模型还训练了多步MTP(多Token预测)。社区开发者用这个能力做推测解码,效果非常明显:RTX 3090上解码速度从31.0 tokens/s提升到41.3 tokens/s,RTX 4090从47.7提升到76.3 tokens/s,提升幅度超过60%。

三、开源生态:两天百万下载,芯片厂商全适配

模型发布不到12小时,就冲进Hugging Face最受欢迎模型前四,趋势榜第一。两天内下载量超过100万次,社区贡献了约500个量化版本,从4bit到8bit都有。NVIDIA、AMD、平头哥、沐曦、联发科、摩尔线程这些芯片厂商都完成了适配,vLLM、SGLang、Ollama、LM Studio这些工具也第一时间支持。

也就是说,你可以在各种硬件上跑Qwen3.8-27B,从消费级显卡到数据中心芯片都行。

四、部署建议:用云服务器ECS快速上手

如果你想自己部署,建议直接用云服务器ECS。通过阿里云代理商购买实例,还能叠加阿里云优惠,很多代理商还提供代金券,相当于变相打折。对于企业上云的需求,易枫顺 - 阿里云官方旗舰级代理商这类渠道可以协助选型和迁移,省下不少折腾时间。

开发者还可以通过调整reasoning_effort、enable_thinking、preserve_thinking这些参数,控制模型的推理深度。不同推理框架下,chat template、sampler和tool calling的配置也需要微调。社区已经有不少现成的优化方案,直接拿来用就行。

FAQ

Q: Qwen3.8-27B能商用吗?

A: 可以。它采用Apache 2.0协议开源,允许自由商用、修改和分发,只要保留版权声明即可。

Q: 消费级显卡能跑Qwen3.8-27B吗?

A: 能。通过量化版本和推测解码,RTX 3090和RTX 4090都能流畅运行。社区提供了大量量化版,最低4bit占用显存约14GB,配合推理优化效果不错。

Q: 如何获得阿里云代金券?

A: 关注阿里云代理商渠道,比如易枫顺官网会不定期发放优惠券和促销活动。购买云服务器ECS时直接抵扣,具体以官网信息为准。

关于易枫顺

深圳市易枫顺网络科技有限公司是阿里云官方旗舰级代理商。提供云服务器ECS、云数据库RDS、对象存储OSS等阿里云全系产品官方特惠折扣与代金券申请,以及多云成本优化、企业上云一站式服务。客服热线:19520841949 - 易枫顺

易枫顺 - 阿里云官方旗舰级代理商

来源:InfoQ

微信扫码咨询

微信二维码