模型 / Qwen3 30B A3B 2507 Instruct

Qwen3 30B A3B 2507 Instruct

价格(每百万 tokens)

输入$0.20¥1.35
输出$0.80¥5.41
混合(3:1)$0.35

汇率 1 USD = 6.7597 CNY(open.er-api.com,Sat, 08 Aug 2026,每日同步)

速度

输出速度- tokens/s
首 token 时间-
首答案 token 时间-

评测覆盖

参与基准14 / 15
综合指数8.90
供应商Alibaba

全部评测指标

智能指数综合8.90
Artificial Analysis 综合智能指数,由多个基准加权得出,反映模型整体推理能力。
代码指数代码-
Artificial Analysis 代码能力指数,综合 LiveCodeBench 等代码基准。
数学指数数学66.30
Artificial Analysis 数学能力指数,综合 AIME 等数学基准。
MMLU Pro学科知识77.7%
大规模多任务语言理解进阶版,衡量跨学科知识广度。
GPQA知识65.9%
研究生水平知识问答(GPQA Diamond),考察专家级科学知识。
HLE评估6.9%
人类最后一场考试(Humanity's Last Exam),极难的综合知识测试。
LiveCodeBench代码51.5%
持续更新的代码生成基准,降低数据污染影响。
SciCode代码30.4%
面向科研场景的数据科学编程题集。
Math 500数学97.5%
OpenAI 收集的 500 道竞赛数学题子集(MATH500)。
AIME数学72.7%
美国数学邀请赛题(老版口径,2023 及以前)。
AIME 2025数学66.3%
2025 版美国数学邀请赛题。
IFBench指令遵循33.1%
指令遵循能力基准(IFEval 中文扩展)。
LCR代码25.3%
代码审查与修复基准(LLM Code Review)。
TerminalBench Hard命令行6.1%
终端 CLI 使用能力高难度子集评测。
Tau2综合10.2%
第三代整体智能基准测试(Tau-Bench 的升级版),综合对话与工具使用。