16:55
DeepSeek元旦发布新论文 开启架构新篇章
格隆汇1月1日|DeepSeek在元旦发布了一篇新论文,提出了一种名为mHC(流形约束超连接)的新架构。该研究旨在解决传统超连接在大规模模型训练中的不稳定性问题,同时保持其显著的性能增益 。这篇论文的第一作者有三位:Zhenda Xie(解振达)、Yixuan Wei(韦毅轩)、Huanqi Cao。值得注意的是,DeepSeek创始人&CEO梁文锋也在作者名单中。

2026-01-011193.5k

商务、渠道、广告合作/招聘立即咨询

相关文章

别了,摩尔;你好,韬(τ)!

哥吉拉 · 昨天 19:43

cover_pic

油价大跳水!美伊即将谈妥?

林春木 · 昨天 21:02

cover_pic

2万亿美元!SpaceX上市前的最后摊牌

发哥挖新股 · 昨天 18:17

cover_pic