海光K100国产显卡实测:GPTQ/AWQ量化模型难以运行,全量版勉强可用
在国产化信创环境下,技术社区针对海光K100显卡进行了大模型部署实测。结果显示,目前主流的GPTQ-Int4和AWQ量化版本,由于依赖CUDA生态或vLLM与ROCm的兼容性问题,均无法正常运行。相比之下,全精度的BF16/FP16模型(如...
标签索引
这个标签下有 4 篇文章。按时间回看相关判断与实践记录。
标签精选
在国产化信创环境下,技术社区针对海光K100显卡进行了大模型部署实测。结果显示,目前主流的GPTQ-Int4和AWQ量化版本,由于依赖CUDA生态或vLLM与ROCm的兼容性问题,均无法正常运行。相比之下,全精度的BF16/FP16模型(如...
据《金融时报》报道,DeepSeek计划于下周发布代号为V4的新一代大语言模型。不同于以往的纯文本模型,V4将是一个支持图片、视频和文本生成的“多模态”模型,标志着其在多模态领域的重大突破。尤为引人注目的是,DeepSeek已与华为及寒武纪...
在AI技术快速发展的背景下,开源模型与硬件适配成为关键痛点。开发者经常面临开源模型与国产GPU卡适配性不明、资源需求不清的问题。当前,国内论坛用户呼吁建立专门网站,查询各开源模型支持的GPU卡类型(包括国产和非国产)及其资源要求。这一需求反...
国产GPU行业正面临激烈竞争,随着国际技术封锁加剧,国内企业加速布局图形处理单元领域,争夺市场窗口期。文章深入分析了中国GPU厂商的技术路线、研发进展及挑战,包括芯片设计、制造工艺和生态建设等方面,探讨了在AI、自动驾驶等前沿领域的应用潜力...