跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 2 页

transformer

这个标签下有 60 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

探秘 AI 内部机制:大语言模型究竟如何产生“情绪”?

本文深入探讨了大型语言模型(LLM)内部处理“情绪”的机制。研究者通过分析 Transformer 架构的电路图,发现模型并非仅仅是简单地模仿人类的情绪语言,而是真的在内部形成了特定的“情绪概念”神经元。这些情绪特征在模型处理对话、角色扮演...

1 分钟阅读105 阅读
前沿哨所

只需5分钟训练一个微型 LLM?这个项目带你打破 AI 黑盒

GuppyLM 是一个仅拥有约 900 万参数的微型语言模型,其独特之处在于它通过扮演一条名叫 Guppy 的小鱼,以此揭开大模型训练的神秘面纱。该项目旨在向大众证明,构建一个 AI 模型并不需要博士学位或昂贵的 GPU 集群。借助谷歌 C...

1 分钟阅读221 阅读
前沿哨所

深度学习里程碑ResNet全解析:残差连接如何重塑神经网络

本文深入解读了何恺明团队的ResNet论文,这是深度学习领域的里程碑之作。文章详细剖析了深层网络面临的“退化问题”,并解释ResNet如何通过引入残差连接,将学习目标从完整映射转化为残差映射,从而有效解决了梯度消失和优化难题。这一创新不仅让...

1 分钟阅读94 阅读