跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 5 页

transformer

这个标签下有 60 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

GLM-Image引入AR模型支持,新功能在望

GitHub上出现一个PR,旨在为GLM-Image适配AR模型的实现。该PR由开发者提交,获得51个赞,显示社区支持。GLM-Image是一个基于Transformer的AI图像模型,此次适配可能预示模型将扩展功能,支持更多应用场景,为未...

1 分钟阅读293 阅读
前沿哨所

Trellis AI招募工程师,构建医疗保健AI代理

Trellis AI是斯坦福AI实验室的衍生公司,专注于构建AI代理以革新医疗保健访问。他们的系统自动化文档处理、预先授权和上诉流程,每年处理价值数十亿美元的治疗,覆盖全美50个州。公司由YC、General Catalyst等知名投资者支...

1 分钟阅读222 阅读
AI 大模型 #AI 模型横评

大模型面试100问01:基础概念与架构篇

TL;DR 面试官问你Transformer原理,你能答到什么深度?本文从12个高频面试题入手,带你搞懂大模型的底层架构——不是背概念,是真正理解为什么GPT用单向注意力、LLaMA为什么选RoPE、多头注意力到底在干什么。读完这篇,你能用...

24 分钟阅读496 阅读
AI 大模型 #AI 模型横评

大模型面试100问:从基础到实战的完整指南

大模型面试100问:从基础到实战的完整指南 为什么需要这个系列? 大模型面试不是背八股文——面试官要的是系统性理解和实战经验。市面上的面试题要么太碎片化(100个孤立问题),要么太理论化(只讲公式不讲应用)。 这个系列不一样: ✅ 系统化:...

16 分钟阅读847 阅读
前沿哨所

AI大师Karpathy:神经网络从零到英雄实战课程

Andrej Karpathy推出“神经网络:从零到英雄”课程,系统讲解从反向传播到现代深度神经网络如GPT的构建过程。课程包括实践项目:micrograd、makemore语言模型、MLP、WaveNet、GPT及其Tokenizer。通...

1 分钟阅读191 阅读
前沿哨所

腾讯开源混元Motion 1.0:AI生成3D动画新突破

混元Motion 1.0是一款基于Diffusion Transformer(DiT)架构与流匹配机制的十亿参数级AI模型,能从自然语言描述生成流畅自然的3D角色动画,覆盖广泛类别并无缝集成到美术管线。该模型由腾讯研发,计划于2025年12...

1 分钟阅读311 阅读
前沿哨所

39岁Java老兵转型AI大模型开发,前辈指点迷津

一位拥有13年Java开发经验的39岁开发者,近日萌生转型AI大模型开发的念头。他已系统学习机器学习、深度学习、Transformer等核心技术,虽感门槛高但充满探索热情。针对转型可行性、常见陷阱及学习路径,他向行业前辈寻求真实建议。这一经...

1 分钟阅读222 阅读