• 回答数

    0

  • 浏览数

    5

  • 收藏数

    0

作者:nbman 发表于 昨天 00:53
跳转到指定楼层
IT之家 8 月 12 日消息,北京时间今天(12 日)晚间,Grok 4.6 正式发布。新模型在 Grok 4.5 基础上进一步强化长时间运行的智能体任务,以及复杂的交互和视觉工作。

按照发布信息,Grok 4.6 能够持续处理包含大量步骤的复杂任务,包括 资料研究、信息分析、大型代码库处理 ,以及将产品构想转化为完整应用或工作成果。

基准测试方面,Grok 4.6 在多项智能体编程和知识工作测试中达到前沿水平。在综合 9 项基准测试的 Artificial Analysis Intelligence Index 上, Grok 4.6 与 GPT-5.6 Sol 取得相同成绩 。



据IT之家了解,Grok 4.6 已在 Cursor 和 Grok Build 上线。首周,两项服务将向用户 提供两倍的内含使用额度 。

训练方面,Grok 4.6 经历了 比 Grok 4.5 更长的补充训练 。

训练数据包括经过筛选的模型生成推理数据和高级技术概念数据,以及高质量工程数据,并配合改进后的优化器和训练方案,为后续监督微调(SFT)和强化学习(RL)提供基础。

训练团队随后利用 Grok 4.5 重新生成 SFT 轨迹,覆盖不同推理强度、智能体运行框架,以及 STEM、软件工程和知识工作等领域,并使用基于模型的检查剔除存在问题的轨迹。

Grok 4.6 还接受了广泛的智能体强化学习训练,任务覆盖知识工作、通用编程、内核优化、Web 开发和计算机辅助设计等领域。

在实际项目测试中,Grok 4.6 重点接受了 长流程、多步骤任务的考验 。

测试结果显示,新模型擅长 把宽泛的产品构想转化为可以运行的初版 ,包括研究陌生领域、规划应用结构、实现核心交互,以及根据多轮反馈持续完善结果。

在更长的任务流程中,Grok 4.6 还表现出更多自主测试和验证行为,会在继续执行任务前检查已经完成的工作。

视觉和交互式项目的初版成果也较 Grok 4.5 有所提升,面对明确的产品构想时,可以一次建立应用的基本结构和视觉语言。

安全方面,Grok 4.6 根据扩展后的模型能力调整了安全防护机制。

此次安全评估覆盖部署前能力测试、安全防护校准,以及部署后和第三方测试,规模为历来最大。

安全体系面向漏洞修补、工程设计和 AI 研究等合法使用场景,在提高实用性的同时控制安全风险。



除 Cursor 和 Grok Build 外,Grok 4.6 也已通过 API 开放,并登陆 OpenRouter、Vercel 和 Cloudflare 等合作平台。

价格为每 100 万个输入 Token 2 美元 (IT之家注:现汇率约合 13.5 元人民币) 、每 100 万个输出 Token 6 美元 (现汇率约合 40.6 元人民币) ,速度更快的版本价格为普通版本的两倍。

首周,Cursor 和 Grok Build 用户可获得两倍的内含使用额度。

[来源链接] https://www.ithome.com/0/988/999.htm
分享:
回复

使用道具

成为第一个回答人

高级模式 评论
您需要登录后才可以回帖 登录 | 立即注册
⚠️

AI客服助手

×
AI
您好!我是AI客服助手,有什么可以帮助您的吗?

请先登录后使用AI客服助手

立即登录
内容由非常AI大模型生成,仅供参考,相关风险需自行承担。

赚钱

会员VIP

留言板

商务合作

联系电话:17308937318

QQ邮箱

QQ:118275

邮箱:118275@qq.com

友情链接