• 回答数

    0

  • 浏览数

    3

  • 收藏数

    0

作者:nbman 发表于 昨天 21:08
跳转到指定楼层
IT之家 8 月 13 日消息,DeepSeek-V4-Pro-0813 正式开源,同时还推出了其开源的代码智能体框架 Harness 的公开测试版,并同步开放了配套的插件生态系统。

截至IT之家发稿,相关 GitHub 仓库仍处于非公开状态(更新:现已公开)。感兴趣的用户可通过 npm 命令安装:

npm i @deepseek-ai/dsh
npx @deepseek-ai/dsh web



“Harness”的通俗定义是将模型转化为智能体的工具。

在大型语言模型之外,Harness 负责调度上下文、工具、任务状态、反馈与边界,把模型能力落地到真实环境中,完成从理解需求到交付代码的完整闭环。

DeepSeek 此前在官方招聘信息中给出了“Model+Harness=Agent”的公式。

在产品定位上,DeepSeek Harness 精准对标 OpenAI Codex 及 Anthropic Claude Code,旨在成为一款主打编程和办公场景的 AI 生产力工具。

团队负责人崔添翼已于 8 月 2 日面向全球公开征集 Harness 内测用户。招募帖发布后,短时间内吸引了数十名全球开发者报名。



DeepSeek Harness(DSH)提供 dsh 命令行工具,用于产品配置与启动。

其核心命令 dsh --profile 用于启动指定配置文件。

该工具支持 Web、Headless 等多种运行模式,并允许通过插件机制进行扩展。

DeepSeek-V4-Pro-0813 是一款基于混合专家(MoE)的模型,总参数量高达 1.6 万亿,实际推理中每个 token 仅激活 490 亿参数。

该模型拥有 100 万 token 的上下文窗口,并支持最大 38.4 万 token 的输出长度。

在交互模式上,V4 Pro 提供“思考模式”与“非思考模式”两种选项,其中思考模式为默认设置。

此外,V4 Pro 全面支持 JSON 结构化输出、Tool Calls、Responses API 和 Anthropic API 等高级功能。

据 DeepSeek 开展的内部测评,正式版相比预览版能力大幅提升,在多项测试中接近甚至超越 Claude Fable 5。

例如在 Terminal Bench 2.1 测试中得分 87.9,远超预览版的 72.1。

在其他测试中,DeepSWE 从 12.8 跃升至 62.7,DSBench-Hard 翻倍至 67.2。

值得关注的是,DeepSeek-V4-Pro-0813 的权重已正式开放。

DeepSeek 的权重采用 MIT 许可证。

此举被解读为将模型底座从对特定算力的依赖中解耦,开发者可下载自建,不再依赖云端单一服务;

国产 GPU、通用算力卡无需厂商定制即可直接运行。

这降低了政企私有化门槛,提升了供应链抗风险能力。

[来源链接] https://www.ithome.com/0/989/446.htm
分享:
回复

使用道具

成为第一个回答人

高级模式 评论
您需要登录后才可以回帖 登录 | 立即注册
⚠️

AI客服助手

×
AI
您好!我是AI客服助手,有什么可以帮助您的吗?

请先登录后使用AI客服助手

立即登录
内容由非常AI大模型生成,仅供参考,相关风险需自行承担。

赚钱

会员VIP

留言板

商务合作

联系电话:17308937318

QQ邮箱

QQ:118275

邮箱:118275@qq.com

友情链接