• 回答数

    0

  • 浏览数

    41

  • 收藏数

    0

作者:admin 发表于 2026-7-27 16:58:14
跳转到指定楼层
IT之家 7 月 27 日消息,Arena( arena.ai )平台今日发布了 2026 年第 30 周的 AI 大模型排行数据,统计周期为 2026-07-20 ~ 2026-07-26。 本周国产模型表现亮眼, 月之暗面旗下的 kimi-k3 蝉联前端开发榜全球第一 ,同时代码榜杀入 Top 10,成为本期最大亮点。 整体榜单中 Anthropic 旗下多款 Claude 新模型集中入榜,头部梯队集中在 1500 分区间,国产模型在多个细分赛道持续实现突破,不少模型进入对应榜单的头部序列,整体竞争力稳步提升。 【综合榜】 综合榜头部格局保持稳定,claude-fable-5 以 1508 分继续蝉联榜首,Anthropic 旗下多款 Claude 系列模型占据前 6 名位置,其中 claude-opus-4-6-thinking、claude-opus-4-7-thinking 等多款新模型完成入榜。 前 7 名模型的 ELO 分差均在 30 分以内,在误差范围内视为并列竞争状态。 Meta 的 muse-spark-1.1 和 muse-spark 分别位列第 7 和第 8,谷歌的 gemini-3.1-pro-preview 上升 2 位来到第 9,前 10 名整体竞争十分胶着。 国产模型在综合榜中整体处于中上游位置,梯队相对完整: • 月之暗面 kimi-k3 位列第 11 名,ELO 1485 分,较上周下降 2 位,是当前排名最高的国产模型; • 阿里 qwen3.7-max-preview 位列第 20 名,ELO 1475 分,较上周下降 2 位; • 智谱 glm-5.1 此前排名第 27,本周位列第 31 名; • 智谱 glm-5.2 (max) 此前排名第 30,本周排名不变。 排名 模型 厂商 分数 (±CI) 票数 价格 ($/M) 输入 / 输出 上下文 1 — 🇺🇸 claude-fable-5 Anthropic 1508 ±6 15817 $10 / $50 1M 2 — 🇺🇸 claude-opus-4-6-thinking Anthropic 1505 ±4 64435 $5 / $25 1M 3 — 🇺🇸 claude-opus-4-7-thinking Anthropic 1502 ±4 51943 $5 / $25 1M 4 — 🇺🇸 claude-opus-4-6 Anthropic 1498 ±4 68145 $5 / $25 1M 5 — 🇺🇸 claude-opus-5-high Anthropic 1495 ±8 5417 $5 / $25 1M 6 — 🇺🇸 claude-opus-4-7 Anthropic 1493 ±4 53093 $5 / $25 1M 7 — 🇺🇸 muse-spark-1.1 Meta 1493 ±7 9573 $1.25 / $4.25 N/A 8 — 🇺🇸 muse-spark Meta 1488 ±6 13497 N/A N/A 9 ↑2 🇺🇸 gemini-3.1-pro-preview 谷歌 1486 ±3 86298 $2 / $12 1.05M 10 ↓2 🇺🇸 gemini-3-pro 谷歌 1486 ±4 41242 $2 / $12 1.05M — 以下为 Top 10 外的国产模型 — 11 ↓2 🇨🇳 kimi-k3 预发布 月之暗面 1485 ±10 3569 $3 / $15 1.05M 20 ↓2 🇨🇳 qwen3.7-max-preview 阿里 1475 ±10 ...
该板块内容需要购买后才能完整浏览
立即购买
分享:
回复

使用道具

成为第一个回答人

高级模式 评论
您需要登录后才可以回帖 登录 | 立即注册
⚠️

AI客服助手

×
AI
您好!我是AI客服助手,有什么可以帮助您的吗?

请先登录后使用AI客服助手

立即登录
内容由非常AI大模型生成,仅供参考,相关风险需自行承担。

赚钱

会员VIP

留言板

商务合作

联系电话:17308937318

QQ邮箱

QQ:118275

邮箱:118275@qq.com

友情链接