4090实测8款30B级大模型:Gemma-4断层第一,Qwen3.5代码封神
本评测基于i9-13900K与RTX 4090顶级配置,针对Gemma与Qwen系列的8款30B级本地模型进行了严苛对比。通过GSM8K、BBH及HumanEval+等基准测试,从逻辑推理、代码生成、速度与稳定性四个维度量化评估。结果显示,...
标签索引
这个标签下有 3 篇文章。按时间回看相关判断与实践记录。
标签精选
本评测基于i9-13900K与RTX 4090顶级配置,针对Gemma与Qwen系列的8款30B级本地模型进行了严苛对比。通过GSM8K、BBH及HumanEval+等基准测试,从逻辑推理、代码生成、速度与稳定性四个维度量化评估。结果显示,...
一位开发者通过编写基于PyTorch的XPU自定义算子,成功在Intel Arc A770/A750显卡上优化了Qwen 3.5多模态大模型。该项目将复杂的递推状态更新与RMSNorm计算融合为单一SYCL内核,显著降低了中间张量的调度开销...
开源项目A.T.L.A.S展示了在单张RTX 5060 Ti(约500美元)的消费级显卡上,通过智能生成、能量验证和自我迭代修复等“推理时计算”技术,成功让14B参数的Qwen3模型在LiveCodeBench测试中得分达到74.6%,超越...