DeepSeek突传大动作。
2月18日,DeepSeek在社交平台X上发布了一篇关于NSA的纯技术论文报告。DeepSeek称,NSA是一种与硬件高度适配并可原生训练的稀疏注意力机制,实现超高速长上下文训练与推理。通过针对现代硬件的优化设计,NSA加快了推理速度,同时降低了预训练成本,而不会影响性能。
与此同时,人工智能初创公司月之暗面也有大动作。2月18日,其宣布推出一款新模型Kimi Latest,它将对标Kimi智能助手当前使用的模型,随智能助手产品更新而同步升级(模型名称始终不变),用户现已可在Kimi开放平台体验。
市场层面,2月18日,港股DeepSeek概念股延续强势,截至收盘,出门问问大涨超16%,创梦天地大涨超12%、美图公司大涨超10%、快手涨超9%。高盛最新研报指出,DeepSeek-R1及中国本土AI模型的突破性进展,正在重塑科技产业叙事逻辑。
DeepSeek发布
2月18日,DeepSeek官方在海外社交平台X上发布了一篇纯技术论文报告,论文主要内容是关于NSA(Natively Sparse Attention,原生稀疏注意力),官方介绍这是一种用于超快速长文本训练与推理的、硬件对齐且可原生训练的稀疏注意力机制,用于超快速的长上下文训练和推理。
校对:赵燕
- THE END -
最后修改:2025年2月18日
非特殊说明,本博所有文章均为博主原创。
如若转载,请注明出处:http://www.mvteam.cn/8981/
共有 0 条评论