多伦多初创公司 Taalas 正式发布首款基于自研 HC1 平台的专用 ASIC 加速卡,通过“存算合一”技术将 Llama 3.1 8B 模型完全硬件化。该方案声称推理吞吐量达每秒 1.7 万 token,成本和功耗较同类 GPU 方案分别降低 20 倍和 10 倍,且无需高带宽存储(HBM)和液冷。尽管公司提供了在线演示并计划升级至 4-bit 浮点格式,但鉴于其采用了激进的非标准量化方案且尚无第三方独立测评,其实际性能表现与模型质量损失仍需市场验证。
挑战 GPU 霸权:Taalas 推出存算一体 ASIC 芯片,成本暴降 20 倍
未经允许不得转载:80aj » 挑战 GPU 霸权:Taalas 推出存算一体 ASIC 芯片,成本暴降 20 倍
相关推荐
实测Qwen 27B在vLLM中开启MTP加速无效,A100环境下性能未获提升
AI热潮“反噬”消费电子:主板销量暴跌超25%,芯片巨头牺牲DIY市场保算力
揭秘门罗币RandomX算法:如何利用“随机指令”让通用CPU逆袭专用芯片
深度测评:AMD MI300X 纸面参数无敌,为何实战惨败?Nvidia 软件护城河难以逾越
用户实测DeepSeek高阶模型代码翻车:思考5分钟未能修复前端BUG
美国商务部突袭禁令:叫停华虹设备出货,华为7nm备胎计划受阻
实测 MTP 技术让推理速度翻倍:Qwen 3.6 表现亮眼,为何 Gemma 4 仍缺席?
网传华为910B2成功跑通DeepSeek V4 Flash,单卡并发能力达20路