00:20
DeepSeek V4 Pro正式上线,向领先层级迈进
格隆汇8月13日|DeepSeek正式发布V4 Pro型号,并在定价页面上将版本号列为DeepSeek-V4-Pro-0813。这款旗舰级产品拥有100万个令牌的上下文窗口和38.4万个令牌的最大输出,默认采用思考模式,同时还提供了一个非思考模式的端点,用于处理对延迟敏感的调用。

对于大型代码库、大型文档语料库和多步骤代理运行,100万输入和38.4万输出的组合意味着单次调用即可摄取和生成比上一代产品多得多的内容。DeepSeek还集成了大多数代理开发者现在所期望的功能:结构化JSON输出、工具调用、Responses API和Anthropic API兼容性,以及对对话前缀延续和FIM补全的测试版支持(FIM仅限非思考模式)。在底层架构方面,该服务同时提供 OpenAI和Anthropic兼容的接口,因此已经在使用任一标准的团队无需重新配置技术栈即可轻松切换。

同时,定价也体现了有意划分的层级。Pro缓存命中费用为每百万代币0.025元,缓存未命中(输入)费用为3元,缓存未命中(输出)费用为6元。相比之下,Flash的相应费用分别为0.02元、1元和2元,这意味着Pro在缓存未命中*输入和输出)方面的成本大约是 Flash的三倍。并发限制也进一步强化了这种差异:Flash支持2500个并发请求,而Pro的并发请求上限为500个。这一比例表明V4系列产品的结构更加清晰。Flash面向高频、高吞吐量的流量,成本是其主要考量因素。Pro则将容量集中于更复杂的推理、长上下文编码和代理工作流程,这些场景下,该模型拥有更大的性能提升空间。Pro的绝对价格按前沿模型的标准来看仍然适中,这使得DeepSeek能够在弥补近期价格上涨带来的成本的同时,仍然低于大多数海外竞争对手。

随着DeepSeek-V4-Pro-0813的推出,V4产品线实际上提供了两条轨道:低成本、高并发的Flash层用于扩展,以及更高规格的 Pro 层,专门针对编码和代理用例。

2026-08-13644.8k

商务、渠道、广告合作/招聘立即咨询

相关文章

7月CPI降至3.4%!沃什可以松一口气了

林春木 · 昨天 22:31

cover_pic

央行Q2货币政策执行报告:继续实施好适度宽松的货币政策

默德君 · 昨天 18:58

cover_pic

腾讯Q2营收略超预期,资本开支激增176%,现金流转负

白野橘 · 昨天 17:54

cover_pic

AI四大主线,重磅信号

哥吉拉 · 昨天 19:50

cover_pic