阿里Qwen3.6登顶:Artificial Analysis认证国产第一

🏆 阿里 Qwen3.6-Max-Preview 登顶:Artificial Analysis 认证最佳国产模型
阿里发布Qwen3.6-Max-Preview,权威第三方评测榜单Artificial Analysis显示:
Qwen3.6-Max-Preview 性能表现超过 GLM-5.1、MiniMax-M2.7 等模型,登顶最佳国产模型!
📊 Artificial Analysis 榜单结果
Artificial Analysis 是权威的 AI 模型独立评测机构,其 Intelligence Index v4.0 包含10 个评测维度:
| 评测维度 | 说明 |
|---|---|
| GDPval-AA | 通用问题解决 |
| τ²-Bench Telecom | 电信领域任务 |
| Terminal-Bench Hard | 终端命令测试 |
| SciCode | 科学代码能力 |
| AA-LCR | 长上下文推理 |
| AA-Omniscience | 知识可靠性 |
| IFBench | 指令遵循 |
| Humanity’s Last Exam | 终极考试 |
| GPQA Diamond | 研究生问题 |
| CritPt | 批判性思维 |
🎯击败国产竞争对手
| 模型 | 提供商 | 排名 |
|---|---|---|
| Qwen3.6-Max-Preview | 阿里 | 🥇 第一 |
| GLM-5.1 | 智谱 AI | 🥈 第二 |
| MiniMax-M2.7 | MiniMax | 🥉 第三 |
| DeepSeek V3 | 深度求索 | 第四 |
Qwen3.6-Max-Preview 在综合评测中超越所有国产竞争对手,登顶最佳国产模型。
✨ Qwen3.6-Max-Preview 特性
1. 百万上下文
Qwen3.6-Max-Preview 支持100万 token 上下文:
- 长文档处理:处理超长文档、代码库
- 多轮对话:保持长时间对话上下文
- 代码理解:理解大型代码项目
2. 编程能力强
Qwen 系列一直以编程能力著称:
- 代码生成:高质量代码生成
- 代码解释:理解复杂代码逻辑
- Bug 修复:精准定位和修复问题
- 多语言支持:Python、Java、C++、Go 等
3. 性价比高
Qwen3.6 系列定价极具竞争力:
| 模型 | 输入价格 | 输出价格 |
|---|---|---|
| Qwen3.6-Plus | $2/1M tokens | $8/1M tokens |
| Claude Sonnet 4.6 | $3/1M tokens | $15/1M tokens |
| GPT-5.4 | $2.5/1M tokens | $10/1M tokens |
Qwen 价格更低,性能却不输国际顶尖模型。
📈 Intelligence vs. Price 对比
Artificial Analysis 的Intelligence vs. Price 图表展示了最佳性价比区域:
- Qwen3.6-Max-Preview 位于「最吸引人的象限」
- 高智能指数 + 低价格 = 最佳性价比
- 击败 MiniMax、智谱 GLM 等国产竞争对手
💡 AA-Omniscience 知识可靠性
AA-Omniscience Index 测量模型的知识可靠性和幻觉率:
- 奖励正确答案
- 惩罚幻觉
- 不惩罚拒绝回答
- 分数范围:-100 到 100
Qwen3.6-Max-Preview 在 Omniscience 测试中表现优异,幻觉率低、知识可靠。
🚀 使用方式
API 调用
# 通义千问 API
curl -X POST https://dashscope.aliyuncs.com/api/v1/services/aigc/text-generation/generation \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-max-preview",
"input": {"prompt": "Hello, Qwen!"},
"parameters": {}
}'
开源版本
Qwen3.6 系列有开源版本:
- Qwen3.6-7B:轻量级开源版本
- Qwen3.6-72B:高性能开源版本
- Apache 2.0 许可证:免费商用
OpenClaw 支持
Qwen 模型已集成到OpenClaw:
# OpenClaw 配置 openclaw config set model qwen-portal/qwen3.6-max-preview
📝 总结
阿里 Qwen3.6-Max-Preview 登顶Artificial Analysis 榜单最佳国产模型:
- 🥇 Intelligence Index 国产第一
- 🏆 超越 GLM-5.1、MiniMax-M2.7
- 📚 百万上下文,编程能力强
- 💰 性价比高,价格低性能好
- ✅ AA-Omniscience 知识可靠性高
- 🚀 API + 开源版本双选择
国产大模型之争,阿里 Qwen3.6 暂时领先。
Artificial Analysis:https://artificialanalysis.ai/models
通义千问官网:https://tongyi.aliyun.com
Qwen GitHub:https://github.com/QwenLM
延伸阅读:
CyberStrikeAI 部署实录:简单的工具部署也要讲细节
最近在折腾 CyberStrikeAI,一个基于 Go 写的 AI 原生安全测试平台。本以为"一键部署"嘛,clone ...
Qoder Sites 上线:一句话发布网页应用,阿里补上 AI 建站最后一公里
AI 建站这条赛道,最近越来越热闹。OpenAI 有 ChatGPT Sites,Codex 有 @Sites 插件,现...
Gemini 桌面版来了:Alt+Space 一键唤醒,Windows 10/11 全球免费下载
Google 终于动手了。9月10日,Gemini 桌面版正式登陆 Windows,全球开放下载,Windows 10 ...
DrawNet.ai:AI 帮你画网络拓扑图,端口级精度,个人永久免费
画网络拓扑图这件事,折磨过太多人。Visio 拖半天,draw.io 连错线,画完还得再开个 Excel 记端口对应关系...
析镜 LensAnalysis 开源:基于 Volatility 3 的图形化内存取证工具,CTF 选手的福音
内存取证这件事,一直有个门槛:Volatility 强大归强大,但命令行参数多到劝退。现在有个国产开源工具把这个门槛拆了...