阿里发布Qwen 3.8开源模型,Apache 2.0许可

摘要
阿里巴巴的Qwen团队发布Qwen 3.8模型,采用Apache 2.0开源许可。该模型为270亿参数稠密模型,在编码和办公任务上优于更大的Qwen 3.7 Plus,原生支持262,000个token的上下文。
背景解释
Qwen 3.8的开源发布为开发者提供了本地和智能体应用的强大基础模型。其长上下文和高效性能,有望降低AI应用开发门槛,推动开源生态发展。
原文译文
以下为抓取到的原文内容译文,已统一为站内阅读格式。
阿里巴巴 Qwen 团队发布 Qwen 3.8 模型,采用 Apache 2.0 许可证开放权重
阿里巴巴 Qwen 团队发布 Qwen 3.8 模型,采用 Apache 2.0 许可证开放权重
阿里巴巴的 AI 团队 Qwen 已发布 Qwen3.8 的开放模型权重。核心模型 Qwen3.8-27B 是一个拥有 270 亿参数的多模态密集模型,据 Qwen 称,其在编码和办公任务上优于更大的 Qwen3.7-Plus。团队还强调了改进的智能体能力,模型能更独立地规划并更可靠地完成任务。它原生支持高达 262,000 个 token 的上下文,并可通过YaRN 方法扩展到一百万。除了文本,它还能处理图像和视频,包括图表、文档和多小时视频。灵活的思考模式默认开启,但可按查询切换。
图片:Qwen权重以 Apache 2.0 许可证发布。Qwen 还发布了更大的 Qwen3.8-2.4T-A95B 的权重,该模型旨在 Max 级别运行。这两个模型均可在Hugging Face和ModelScope上获取。通过阿里巴巴的 AI 服务Qwen Cloud,即将提供支持一百万个 token 上下文的托管版本。广告 广告
无炒作 AI 新闻——由人类精选
订阅 THE DECODER 以享受无广告阅读、每周 AI 通讯、每年六次的独家“AI 雷达”前沿报告、完整档案访问以及评论区的访问权限。
来源地区
Europe
热度分
89
分类
开源模型
语言
en
