DeepSeek,重磅发布

原创1 小时前17.1k
竟争开始激烈?

9月10日,DeepSeek正式发布V4.1Flash模型,官网、App和API三端同步上线。

官方给V4.1Flash的定位是新一代模型结构系列里尺寸最小的版本,目标却要同时抬高能力上限、推理速度和吞吐能力。

模型总参数552B,属MoE架构,采用全新的CausalEncoderDecoder设计。输入与输出走非对称计算,输入阶段激活约8B参数,输出阶段激活约16B参数。参数规模留着,实际推理只调用其中一部分。

配合FP4精度的KVCache,HBM需求降到上一代的四分之一,SSD需求降到八分之一,相较初代模型,缓存规模已缩小约437倍。

推理流程上,CSA2跨层复用缓存并用Top-K索引挑出重要信息,DSpark用轻量模块提前预判一部分token。官方测试显示,V4.1Flash在软件工程、网络安全和自动化任务等多项Agent评测中超过V4Pro。

价格同步下调,新费率9月10日中午生效,仍沿用峰谷分时机制,闲时价格是高峰时段的一半。API侧把模型名改成deepseek-flash即可切换,旧版本已经下线,旧名称暂时自动路由。9月14日中午之后,访问deepseek-v4-pro的请求会全部转向V4.1Flash,并按Flash的单价计费。腾讯WorkBuddy、CodeBuddy与OpenCode已完成接入。

港股两家大模型今日下跌,智谱盘中跌逾10%,尾盘报价在814港元附近,MiniMax跌逾9%,最低触及288.60港元。9月以来,两家公司累计回撤分别接近三成和一成四。

机构对大模型行业竞争的看法存在分歧。

摩根士丹利认为无序恶性竞争的概率不高,旗舰加轻量的双线布局已是行业标准,调价后V4Flash的整体费率仍高于2026年4月初,相对Qwen3.8-flash和GLM5.3-flash也还留着溢价。

杰富瑞的看法相反,直言中国大模型赛道过于拥挤,更看好算力和数据占优、资产负债表强健的全栈云厂商,并把智谱云业务的市销率倍数从50倍砍到30倍。

DeepSeek概念股板块全天收跌1.19%,主力资金净流出83.47亿元,板块里涨停的只有两家,游族网络和中新赛克双双封板。

根据路透社报道,DeepSeek已聘请中信证券筹备科创板上市,计划年内启动IPO流程。21世纪经济报道求证后补充,中信证券已进入尽职调查阶段,双方尚未签订正式的上市辅导协议,浙江证监局官网目前也查不到上市备案信息。

按辅导备案不少于三个月的要求,公司需要在9月提交材料,才有望在年内递交申请。

2026年前七个月DeepSeek营收约4.75亿元,已是2025年全年的十倍左右,同期净亏损7.15亿元,综合毛利率44.6%。

市场给的最新估值是5000亿元人民币,有分析据此推算,上市后市值区间落在1.5万亿到2.5万亿元。

相关主题/热点

格隆汇声明:文中观点均来自原作者,不代表格隆汇观点及立场。特别提醒,投资决策需建立在独立思考之上,本文内容仅供参考,不作为实际操作建议,交易风险自担。

App内直接打开
商务、渠道、广告合作/招聘立即咨询

相关文章

从电子布涨至覆铜板,AI算力如何搅动PCB全产业链?

览富财经 · 7分钟前

cover_pic

2026年全球体外尿液收集装置市场销售额规模达到52.22亿元

细分市场报告智库 · 9分钟前

cover_pic

全球与中国医生排班和调度系统市场规模分析及行业发展趋势研究报告

细分市场报告智库 · 11分钟前

cover_pic
我也说两句