北京
DongfangScience 科学,为了更美好的明天
智能

DeepSeek发布V4-Pro正式版,升级智能体功能并调整API定价

该中国人工智能实验室在4月发布预览版四个月后,于8月13日正式推出其规模最大的开放权重模型。

从西湖对岸眺望杭州天际线
从西湖对岸眺望杭州天际线 图片: Windmemories, CC BY-SA 4.0 来自维基共享资源

中国人工智能公司DeepSeek于8月13日发布了DeepSeek-V4-Pro正式版,使其旗舰模型走出了自4月开始的预览阶段。该公司表示,此次更新为智能体能力带来重大升级,也就是模型调用工具并执行多步骤任务的这类能力,并称该模型现已可通过其应用程序、网站和API使用。

根据DeepSeek的公告,此次更新为V4-Pro和较小型的V4-Flash新增了可调节的推理强度级别,分为低、高和最大三档,方便开发者根据任务难度匹配推理量。更新还为OpenAI的Responses API格式增加了原生支持,并针对Codex进行了优化整合。在消费级应用和网站上,V4-Pro可通过名为“专家模式”的选项使用,API模型名称保持不变。

该公司还调整了API使用的计费方式。从8月16日16:00(UTC)起,DeepSeek推出了高峰和非高峰两档价格,非高峰价格比高峰价格低50%。DeepSeek表示,这一价格结构旨在让客户在安排工作负载时拥有更大的灵活性。

V4系列于4月24日首次以开源预览版形式亮相,包含两款混合专家(MoE)模型。V4-Pro共有1.6万亿个参数,其中每个token激活490亿个参数,而V4-Flash总参数为2840亿个,激活参数为130亿个。两款模型均支持100万token的上下文窗口,并可在思考模式或非思考模式下运行。相关权重已发布在Hugging Face平台上,V4-Pro的模型卡标明采用MIT许可证。

长上下文是该系列的主要技术亮点。DeepSeek表示,V4采用了一种新的注意力机制设计,将逐token压缩与DeepSeek稀疏注意力相结合,并将100万token设为其官方服务的默认上下文长度。《麻省理工科技评论》报道称,在100万token的上下文下,V4-Pro所需算力仅为此前V3.2模型的27%,内存占用降至10%。对于V4-Flash,相应数字分别为10%的算力和7%的内存。

此次发布也被视为对中国国产芯片供应能力的一次检验。《麻省理工科技评论》称,V4是DeepSeek首款针对华为昇腾等中国国产芯片进行优化的模型,并指出华为已宣布其基于昇腾950系列的昇腾超节点产品支持该模型。

在预览阶段,《麻省理工科技评论》曾列出V4-Pro的API价格为每百万输入token 1.74美元,每百万输出token 3.48美元。DeepSeek还表示,其较早的deepseek-chat和deepseek-reasoner API模型将于2026年7月24日后停用。发布时公布的与其他领先闭源模型的性能对比数据来自该公司自身测试。

来源

  1. DeepSeek API Docs: DeepSeek-V4-Pro GA Releaseapi-docs.deepseek.com
  2. DeepSeek API Docs: DeepSeek V4 Preview Releaseapi-docs.deepseek.com
  3. MIT Technology Reviewtechnologyreview.com
  4. Hugging Face: deepseek-ai/DeepSeek-V4-Prohuggingface.co

更多: 智能AI & Robotics

更多