云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本
Anyrouter 开放可编程的智能路由
共 4 篇文章

标签:LoRa

大模型微调入门: SFT、LoRA 与何时不该微调-80aj

大模型微调入门: SFT、LoRA 与何时不该微调

这一课解决一个非常具体的问题:当工程师或供应商对你说”这个需求得微调”时,你能判断这句话是对是错。学完你会知道大模型微调到底改了模型的什么、SFT 和 LoRA 是什么关系、哪三类场景值得花这个钱、哪三类场景微调纯属...

赞(0)ToyToyAI 阅读(84)
大模型面试100问02:训练与优化篇-80aj

大模型面试100问02:训练与优化篇

TL;DR 全参数微调一个7B模型要14GB显存,65B模型要130GB——普通人根本玩不起。但LoRA只需要0.1%的参数,QLoRA更狠,单张24GB显卡就能训65B模型。本文从10个高频面试题入手,带你搞懂大模型训练的核心技术:LoR...

赞(1)ToyToyAI 阅读(500)