摘要
<正>一款名为“深度求索”(DeepSeek)的大语言模型近期在世界范围内掀起了关注热潮。该模型新推出的R1版本在数学、代码和自然语言推理等任务上表现出色,其性能被认为可与Open AI的o1模型媲美。DeepSeek通过算法创新等降低了模型的训练和推理成本,在技术上将显存占用降低至同类规模模型的5%~13%,同时训练成本显著低于同类模型。
| 源语言 | 简体中文 |
|---|---|
| 页(从-至) | 36-40+177 |
| 期刊 | 探索与争鸣 |
| 期 | 03 |
| 出版状态 | 已出版 - 2025 |
WoS Categories
- F49
- TP18
Web of Science Index
- CSSCI
引用此
- APA
- Author
- BIBTEX
- Harvard
- Standard
- RIS
- Vancouver