全球大模型进展新闻浏览站
中文头版English
输入关键词,快速查找已抓取新闻。

今日版 / 2026年8月12日星期三

limbo logolimbo

数据更新时间

8月12日 23:12

启用来源

-

抓取状态

数据库优先

模型简介

阿里推出的大模型家族,覆盖通用、代码、多模态和开源生态。

查看详细介绍和发展时间线+

Qwen 是阿里推出的大模型家族,覆盖通用语言模型、代码模型、多模态模型、数学推理、工具调用和开放权重生态。它在中文、多语言、代码生成和企业场景中都有较高关注度,也经常通过开源社区和 ModelScope 等生态扩散。

Qwen 对中文用户和开发者尤其重要,因为它同时提供云端 API、开放模型和企业部署选择。它的更新通常会影响中文问答、代码助手、智能体工具调用、企业知识库和国产化应用栈的发展。

发展时间线

Qwen 起源于阿里的通义千问,2023 年先以产品和云服务形态出现,随后陆续发布 7B、14B、72B 等开放权重模型,开始在中文和多语言社区扩散。

Qwen2、Qwen2.5 阶段扩展到代码、视觉、音频和数学推理,QwQ 等推理模型让它进入“思考模型”和复杂问题求解的竞争。

Qwen3 之后,阿里把开放权重、云端 API、专用代码模型和多模态模型并行推进,Qwen 成为中文开发者生态里最活跃的模型家族之一。

Heat / Trend

讨论热度曲线

真实社区信号:HN points/comments + GitHub stars/forks

0450900热度分 742 · 条目 1 · 时间 01/09社区热度01/09 · 742 分 · 1 条热度分 794 · 条目 1 · 时间 01/30社区热度01/30 · 794 分 · 1 条热度分 724 · 条目 1 · 时间 03/05社区热度03/05 · 724 分 · 1 条热度分 2 · 条目 1 · 时间 06/27社区热度06/27 · 2 分 · 1 条热度分 8 · 条目 2 · 时间 06/29社区热度06/29 · 8 分 · 2 条热度分 2 · 条目 1 · 时间 06/30社区热度06/30 · 2 分 · 1 条热度分 834 · 条目 1 · 时间 07/01社区热度07/01 · 834 分 · 1 条01/0906/2707/01日期社区热度分
按真实讨论发生/仓库更新时间聚合01/09 - 07/01

总热度

3106

讨论条目

8

峰值日期

07/01

Community / HN + GitHub

社区讨论

来自 Hacker News 与 GitHub 的最新讨论和仓库热度,用来补充新闻之外的社区反馈。

HN

4

GitHub

4

热度

3106

official / Qwen

官网发布

Qwen Blog热度 89AI 摘要

Qwen3Guard:实时安全检测模型发布

Qwen 团队推出首个安全护栏模型 Qwen3Guard,基于 Qwen3 微调,可对提示和响应进行精确安全分类,包括风险等级和类别。在多项安全基准测试中达到领先水平,支持中英文及多语言环境。

Hugging FaceQwenQwen3
Qwen Blog热度 84AI 摘要

Qwen推出图像编辑模型,实现高质量文本编辑

Qwen团队发布Qwen-Image-Edit,基于20B参数的Qwen-Image模型,将文本渲染能力扩展到图像编辑任务,支持精确文本编辑。该模型同时利用Qwen2.5-VL进行视觉语义控制,VAE编码器进行视觉外观控制,实现语义和外观编辑。

Hugging FaceQwen

media / Qwen

媒体报道

The Decoder热度 76AI 摘要

Claude Code 的中美双重禁令困境

Anthropic 试图阻止字节跳动、蚂蚁金服等中国企业访问 Claude Code,但对方通过 VPN 和海外子公司绕过限制。同时,阿里巴巴因发现隐藏代码可识别中国用户,禁止员工使用该工具。

AlibabaAnthropicClaude

research / Qwen

研究论文

arXiv AI / CL热度 89AI 摘要

语言表达如何影响大模型:信念表达方式对模型响应的影响

用户常向大语言模型表达信念,但表达方式(如预设、证据标记、语气等)会影响模型是否采纳上下文。研究引入分类法,系统评估17种语言表达类型对模型遵循上下文或坚持先验知识的影响,发现更大模型和指令模型更不遵循上下文。

LlamaQwenQwen3
arXiv AI / CL热度 81AI 摘要

Muon优化器在智能体强化学习中的潜力初探

一项新研究探索了Muon优化器在稀疏奖励智能体强化学习中的效果。在ALFWorld任务上,使用Qwen2.5-0.5B-Instruct模型和GiGPO算法,仅对隐藏权重矩阵应用Muon,最终窗口验证成功率从0.290提升至0.546,提升88%。效果依赖于优势估计器和学习率。

Qwen
arXiv AI / CL热度 89AI 摘要

OpenThoughts-Agent:开源智能体模型训练数据配方

OpenThoughts-Agent项目提出完全开源的数据筛选流程,用于训练通用智能体模型。通过100多次对照实验,系统研究各阶段重要性,并构建10万样本训练集。基于Qwen3-32B微调,在7个智能体基准上平均准确率44.8%,比最强开源模型Nemotron-Terminal-32B高3.9个百分点。

Qwen
VentureBeat AI热度 89AI 摘要

Nous Research发布开源编程模型NousCoder-14B,四天训练挑战Claude Code

Nous Research推出开源编程模型NousCoder-14B,在LiveCodeBench v6上准确率达67.87%,超越多个更大规模专有系统。模型仅用48块英伟达B200 GPU训练四天,并公开了完整训练框架,强调可复现性。此举正值Anthropic的Claude Code引发热议之际,凸显AI编程工具竞争白热化。

AlibabaAnthropicGoogleHugging Face
United States原文链接

community / Qwen

社区/开源动态