Qwen 起源于阿里的通义千问,2023 年先以产品和云服务形态出现,随后陆续发布 7B、14B、72B 等开放权重模型,开始在中文和多语言社区扩散。
今日版 / 2026年8月12日星期三
limbo数据更新时间
8月12日 23:12
启用来源
-
抓取状态
数据库优先
模型简介
阿里推出的大模型家族,覆盖通用、代码、多模态和开源生态。
查看详细介绍和发展时间线+
Qwen 是阿里推出的大模型家族,覆盖通用语言模型、代码模型、多模态模型、数学推理、工具调用和开放权重生态。它在中文、多语言、代码生成和企业场景中都有较高关注度,也经常通过开源社区和 ModelScope 等生态扩散。
Qwen 对中文用户和开发者尤其重要,因为它同时提供云端 API、开放模型和企业部署选择。它的更新通常会影响中文问答、代码助手、智能体工具调用、企业知识库和国产化应用栈的发展。
发展时间线
Qwen2、Qwen2.5 阶段扩展到代码、视觉、音频和数学推理,QwQ 等推理模型让它进入“思考模型”和复杂问题求解的竞争。
Qwen3 之后,阿里把开放权重、云端 API、专用代码模型和多模态模型并行推进,Qwen 成为中文开发者生态里最活跃的模型家族之一。
Heat / Trend
讨论热度曲线
真实社区信号:HN points/comments + GitHub stars/forks
总热度
3106
讨论条目
8
峰值日期
07/01
Community / HN + GitHub
社区讨论
来自 Hacker News 与 GitHub 的最新讨论和仓库热度,用来补充新闻之外的社区反馈。
HN
4
GitHub
4
热度
3106
QwenLM/qwen-code
分数
834
Stars
25694
Forks
2584
QwenLM/Qwen3-VL
分数
794
Stars
19501
Forks
1798
QwenLM/Qwen3
分数
742
Stars
27346
Forks
1999
QwenLM/Qwen
分数
724
Stars
21366
Forks
1842
Show HN: Cline subscription plan to access GLM-5.2 at 2-5x discount
分数
7
评论
2
来源
HN
Qwen3.5 2B burns all the output tokens while thinking
分数
2
评论
0
来源
HN
Show HN: Apex-1-flash, 4B LLM finetuned on RTX 5070
分数
2
评论
0
来源
HN
Show HN:Swarm intelligence without degradation using two Qwen models
分数
1
评论
0
来源
HN
official / Qwen
官网发布
Qwen3Guard:实时安全检测模型发布
Qwen 团队推出首个安全护栏模型 Qwen3Guard,基于 Qwen3 微调,可对提示和响应进行精确安全分类,包括风险等级和类别。在多项安全基准测试中达到领先水平,支持中英文及多语言环境。
Qwen推出图像编辑模型,实现高质量文本编辑
Qwen团队发布Qwen-Image-Edit,基于20B参数的Qwen-Image模型,将文本渲染能力扩展到图像编辑任务,支持精确文本编辑。该模型同时利用Qwen2.5-VL进行视觉语义控制,VAE编码器进行视觉外观控制,实现语义和外观编辑。
media / Qwen
媒体报道

阿里新模型宣传视频:AI工作,人享乐
阿里巴巴为其新AI模型Qwen 3.8发布宣传视频,展示AI工作而人享受爱好,与OpenAI和Anthropic的失业警告形成对比。但本质上仍是营销。

Claude Code 的中美双重禁令困境
Anthropic 试图阻止字节跳动、蚂蚁金服等中国企业访问 Claude Code,但对方通过 VPN 和海外子公司绕过限制。同时,阿里巴巴因发现隐藏代码可识别中国用户,禁止员工使用该工具。
research / Qwen
研究论文

语言表达如何影响大模型:信念表达方式对模型响应的影响
用户常向大语言模型表达信念,但表达方式(如预设、证据标记、语气等)会影响模型是否采纳上下文。研究引入分类法,系统评估17种语言表达类型对模型遵循上下文或坚持先验知识的影响,发现更大模型和指令模型更不遵循上下文。

Control Under Compression: Reliability Frontiers for Tool-Using Agents
这条新闻已抓取入库,中文摘要正在生成中。你可以先打开原文查看完整内容。

Muon优化器在智能体强化学习中的潜力初探
一项新研究探索了Muon优化器在稀疏奖励智能体强化学习中的效果。在ALFWorld任务上,使用Qwen2.5-0.5B-Instruct模型和GiGPO算法,仅对隐藏权重矩阵应用Muon,最终窗口验证成功率从0.290提升至0.546,提升88%。效果依赖于优势估计器和学习率。

ReToken: One Token to Improve Vision-Language Models for Visual Retrieval
这条新闻已抓取入库,中文摘要正在生成中。你可以先打开原文查看完整内容。

OpenThoughts-Agent:开源智能体模型训练数据配方
OpenThoughts-Agent项目提出完全开源的数据筛选流程,用于训练通用智能体模型。通过100多次对照实验,系统研究各阶段重要性,并构建10万样本训练集。基于Qwen3-32B微调,在7个智能体基准上平均准确率44.8%,比最强开源模型Nemotron-Terminal-32B高3.9个百分点。

免费AI编程助手Goose崛起,挑战每月200美元的Claude Code
Block公司推出的开源AI代理Goose,可本地运行并免费使用,功能与Anthropic的Claude Code类似,但无需订阅费或云依赖。Goose支持多种语言模型,包括本地部署,已获超2.6万GitHub星标。

Nous Research发布开源编程模型NousCoder-14B,四天训练挑战Claude Code
Nous Research推出开源编程模型NousCoder-14B,在LiveCodeBench v6上准确率达67.87%,超越多个更大规模专有系统。模型仅用48块英伟达B200 GPU训练四天,并公开了完整训练框架,强调可复现性。此举正值Anthropic的Claude Code引发热议之际,凸显AI编程工具竞争白热化。
community / Qwen
社区/开源动态

阿里发布Qwen 3.8多模态模型,称仅次于Fable 5
阿里巴巴推出Qwen 3.8多模态AI模型,拥有2.4万亿参数,据称性能仅次于Fable 5,现已开放预览。该模型对标Kimi K3,采用开放权重发布。