DeepSeek近日宣布其V4 Pro正式版正式上线,同时开源了Agent框架DeepSeek Harness(DSH)的v0.1预览版,为用户和开发者带来更强大的功能支持。作为推理大模型领域的最新力作,V4 Pro在多项基准测试中表现优异,甚至超越了Anthropic旗下定位最高的Claude Opus 4模型,标志着DeepSeek在智能体技术方面迈入行业前列。
V4 Pro与轻量级的V4 Flash形成互补,前者定位为高性能推理模型,后者则专注于资源效率。而DSH框架的引入,进一步拓展了模型的应用场景。通过这一平台,AI能够像人类一样操作本地文件、执行命令、联网搜索,实现从“大脑”到“完整智能体”的转变。对于普通用户,DeepSeek已开放零成本体验通道,只需在网页或App端开启深度思考功能,系统便会自动调用V4 Pro处理复杂任务。
性能数据方面,V4 Pro在DeepSWE基准测试中取得62.7分,远超Claude Opus 4的参考值7.3。在Terminal Bench、Cybergym等测试中,其表现也接近或超越这一竞争对手。模型支持最高500路并发请求,较Flash版的250路翻倍,为高负载场景提供了更强的处理能力。开发者还迎来两项重要升级:新增Anthropic API端点,可无缝接入OpenAI生态;Strict模式(Beta)确保Function输出严格遵循Schema定义,提升接口稳定性。
技术层面,V4系列延续了DSA稀疏注意力方案,在保持百万级上下文理解能力的同时,显著降低算力需求。用户可根据任务复杂度选择low/high/max三档思考强度,平衡处理能力与Token消耗。价格调整方面,官方引入峰谷定价机制:北京时段9:00-12:00、14:00-18:00为高峰期,V4 Pro输入价格(缓存命中)涨至0.30元/百万Tokens,涨幅约12倍;输入(缓存未命中)涨至9元,涨幅约3倍。Flash版价格涨幅相对温和,输出成本约涨2.25倍,更适合轻量场景。
面对成本上升,DeepSeek建议用户灵活切换模型版本:高峰期使用Flash处理常规请求,非高峰期切换至Pro版执行复杂任务,或通过夜间批量操作优化成本。这一策略既满足了高性能需求,又为预算敏感型用户提供了可行方案。随着V4全系列模型的落地,DeepSeek正以技术突破与商业化平衡的双重优势,重塑大模型市场的竞争格局。












