DeepSeek V4 Pro正式上线:性能跃升显著 峰谷定价助力灵活算力管理

   发布时间:2026-08-15 00:02 作者:沈如风

近日,人工智能领域迎来重要更新,DeepSeek正式推出V4 Pro正式版,同时开源其Agent框架DeepSeek Harness(DSH)v0.1预览版,为开发者与用户带来更专业的功能体验。此次升级不仅强化了模型的核心能力,还通过框架扩展了AI的应用边界,标志着技术落地迈入新阶段。

DeepSeek-V4-Pro定位为高性能推理大模型,与其轻量级版本V4-Flash形成互补。前者专注于复杂任务处理,后者则以高效低成本见长。而DSH框架的引入,进一步突破了模型能力的边界——通过整合文件读写、命令执行、网络搜索等功能,将V4-Pro从“超级大脑”升级为具备行动能力的智能体。例如,用户可通过该框架让AI自动完成数据整理、代码调试等跨领域任务,无需依赖外部工具链。

对于普通用户,DeepSeek简化了体验流程。在网页端或App中开启“深度思考”功能后,系统会自动识别任务难度,并在需要时调用V4-Pro模型。这一设计降低了技术门槛,使零成本使用高级AI成为可能。开发者层面,新版本新增Responses API与Anthropic格式支持,通过适配OpenAI生态的API端点,实现代码迁移的“无缝切换”。同时,Strict模式(Beta)通过强制JSON输出符合Schema定义,显著提升了接口调用的稳定性。

性能测试数据显示,V4-Pro在多项基准中表现优异。在DeepSWE测试中取得62.7分,远超Claude Opus 4的参考值7.3;在Terminal Bench、Cybergym等场景中,其能力也接近或超越同类竞品。这些成果得益于DSA稀疏注意力方案的持续优化,该技术通过动态分配计算资源,在保持百万级上下文理解能力的同时,将算力需求降低至行业平均水平的三分之一。

针对不同场景需求,V4-Pro与V4-Flash均提供三档思考强度选项。用户可根据任务复杂度,在“low/high/max”模式间灵活切换,平衡处理能力与Token消耗。例如,简单问答可选择低强度模式以节省成本,而代码生成或逻辑推理任务则可启用最高档位。并发支持方面,V4-Pro将单模型最大并发数提升至500路,较Flash版本翻倍,为高流量应用提供了硬件层面的保障。

随着全系列模型正式上线,DeepSeek同步调整了API定价策略,并引入峰谷时段机制。自8月17日起,北京时间9:00-12:00、14:00-18:00为高峰时段,其余时间为空闲时段,后者价格仅为前者的一半。以V4-Pro为例,高峰时段输入价格(缓存命中)为0.30元/百万Tokens,较此前上涨约12倍;输入(缓存未命中)则从3元涨至9元。相比之下,V4-Flash的涨幅更为温和,输出成本仅增加2.25倍,更适合预算有限的轻量级应用。

此次更新虽导致成本上升,但V4-Pro在复杂任务处理中的优势仍具吸引力。对于算力需求大的用户,建议结合峰谷时段灵活调用模型——高峰期使用V4-Flash应对常规请求,非高峰期切换至V4-Pro处理高难度任务,或通过批量任务调度进一步优化成本。这一策略既保证了性能需求,又能在长期使用中实现资源高效配置。

 
 
更多>同类内容
全站最新
热门内容
 
智快科技微信账号
微信群

微信扫一扫
加微信拉群
电动汽车群
科技数码群