Deepseak Architecture

1 天

DeepSeek自上线以来便以迅猛的速度在全球范围内获得了广泛关注，其日活用户数在短时间内突破2000万，成为全球增速最快的AI应用之一。作为一家中国人工智能初创企业，外部算力 ...

2 天

DeepSeek自上线以来便以迅猛的速度在全球范围内获得了广泛关注，其日活用户数在短时间内突破2000万，成为全球增速最快的AI应用之一。作为一家中国人工智能初创企业，外部算力（主要是GPU）限制逐渐成为制约其进一步发展的瓶颈，如今他们正致力于通过优 ...

2 天

绕过英伟达CUDA框架！DeepSeek或将兼容国产GPU，迎接AI技术新纪元

近年来，人工智能技术发展迅猛，尤其在大语言模型（Large Language Models, LLMs）领域，各大公司纷纷角逐。近日，外媒Tom’s Hardware报道，DeepSeek公司在其最新研发的大语言模型中，成功绕过了英伟达的CUDA框架 ...

2 小时

我们应如何看待DeepSeek的557.6万美元训练成本？

简单来说，DeepSeek-V3仅使用了2048块英伟达H800 GPU，耗费了557.6万美元就完成了训练，相比同等规模的模型（如GPT-4、GPT-4o、Llama 3.1），训练成本大幅降低。

腾讯网1 天

DeepSeek绕过CUDA！为适配中国国产GPU做准备

2月5日消息，DeepSeek全球爆火，再一次引发外界对GPU算力限制话题的关注。据报道，DeepSeek开发的大语言模型绕过了英伟达的CUDA框架，正为未来兼容国产GPU芯片做准备。众所周知，英伟达的CUDA（Compute Unified ...

星島網4 天

DeepSeek︱传为改用国产GPU做准备跳出NVIDIA限制

内地AI新创公司深度求索（DeepSeek），开发的大语言模型时，绕过美国人工智能巨头辉达（NVIDIA）的CUDA框架，有内媒报道，DeepSeek正为未来适配国产GPU晶片做准备。

1 天

曝DeepSeek绕过CUDA！为适配中国国产GPU做准备跳出英伟达限制

这也说明DeepSeek拥有一些擅长写PTX语言的内部开发者。

1 天

华为与DeepSeek联手会发生什么：算力已达英伟达60%、CANN取代CDUA架构

根据DeepSeek 研究人员的测试，在推理任务中，昇腾910C性能可达H100的60%。据悉，升腾910C采用chiplet封装，第二代7nm级（N+2）工艺，整合约530亿个晶体管。此外，通过手动优化CANN内核，其效率可以进一步提高。

See Hua Daily News3 天

DeepSeek传为改用中国国产GPU做准备

（北京4日讯）中国AI新创公司“深度求索”（DeepSeek）开发的大语言模型绕过美国人工智慧巨头英伟达（Nvidia）的CUDA框架，据报导，DeepSeek正为未来适配中国国产GPU晶片做准备。香港星岛日报网引述中媒报导，英伟达的“统一运算架构”（Compute Unified Devi ...

Lianhe Zaobao4 天

传DeepSeek正准备适配中国国产GPU

中国初创企业深度求索（DeepSeek）研发大语言模型时据报绕过了美国人工智能巨头英伟达的CUDA框架，为DeepSeek在未来适配中国国产晶片做好准备。由英伟达开发的软硬体整合技术“统一计算架构”（Compute Unified Device ...

来自MSN2 天

DeepSeek 绕开 CUDA 垄断，针对英伟达 PTX 进行优化实现最大性能，英伟 ...

这个内容已经在X上讨论过了，很火热的问题我先翻译一下国外教授的详细回答，再讲清楚CUDA、PTX的关系。中文翻译：人们说“Deepseek 使用了 PTX，它打破了 CUDA 的护城河！”从根本上误解了这里发生的事情，以及 CUDA ...

sinchew4 天

DeepSeek或绕开辉达适配中国产GPU

（北京3日综合电）中国媒体周一引述消息报道，中国初创企业深度求索（DeepSeek）研发大语言模型时据报绕过了美国人工智能巨头辉达的 CUDA 框架，为其在未来适配中国国产晶片做好准备。由辉达开发的软硬体整合技术“统一计算架构”（Compute ...

一些您可能无法访问的结果已被隐去。

显示无法访问的结果