DeepSeek准:备适配国产G?PU, 、绕开英伟达CUDA
DeepSeek要适配国产GPU了?这确实是大好事一件。据报道,DeepSeek在研发大模型时绕过了英伟达的护城河CUDA,这意味着可以直接根据GPU的驱动函数做一些新的开发,从而实现更加细粒度的操作。
例如DeepSeek在多节点通信时绕过了CUDA直接使用PTX(ParallelThreadExecution),其最多只能实现以算法的方式来高效利用硬件层面的加速。
一旦速度变得更快,打个比方这就意味着别人家的模型要训练十天,而DeepSeek只需要训练五天,那么就能给模型喂更多的数据,即能让模型在同等时间内看到更多的数据,间接提高模型的效果。
按照消息人士的说法,DeepSeek拥有一些擅长写PTX语言的内部开发者。
那么,假如它之后使用国产GPU,其在硬件适配方面将会更得心应手,其只要了解这些硬件驱动提供的一些基本函数接口,就可以仿照英伟达GPU硬件的编程接口去写相关的代码,从而让自家大模型更加容易适配国产硬件。
(内容来源:南方都市报)
作者: 编辑:王思琪
越牛新闻客户端
越牛新闻微信
绍兴发布微信
越牛新闻微博
绍兴发布微博
新闻热线
0575-88880000
投稿信箱
zjsxnet@163.com