腾讯近日推出首个基于Diffusion技术的大语言模型WeDLM-8B。该模型在数学推理任务中,经vLLM优化后,相比Qwen3-8B速度提升3-6倍;在多数基准测试中,性能超越原始Qwen3-8B-Instruct。原生支持KV Cache,兼容FlashAttention、PagedAttention和CUDA Graphs等技术,模型已在Hugging Face平台开放。腾讯强调通过开源和开放科学推动AI进步,加速技术民主化。
腾讯发布首个Diffusion大模型WeDLM-8B,性能飞跃
未经允许不得转载:80aj » 腾讯发布首个Diffusion大模型WeDLM-8B,性能飞跃







