云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本
FoxCode AI Coding 助手

AI 模型横评 第6页

Claude / GPT / Gemini / Grok / DeepSeek / Qwen / Llama / MiniMax 等主流大模型在能力、价格、速度、使用场景上的横评与选型建议(按月更新)。
红杉说这就是 AGI,然后呢?-80aj

红杉说这就是 AGI,然后呢?

2026 年春天,红杉资本 AI Ascent 峰会上,三位合伙人 Pat Grady、Sonia 和 Constantine 轮番上台,做了一场不到 40 分钟的开场 keynote。Pat 在中间某段轻描淡写地丢出一句话——"if we may be so bold, we would say that this

赞(5)ToyToyAI 阅读(254)
Dense vs MoE:大模型架构的选择题-80aj

Dense vs MoE:大模型架构的选择题

选 Dense 还是选 MoE?这个问题在 2025 年之后已经不怎么争议了——大多数顶级闭源模型(GPT-4 系列、Gemini、DeepSeek-V3)都用了 MoE。但这不意味着 Dense 没用了。两种架构各有清晰的能力边界,选错架构的代价远大于选错模型大小。 Dense 模型就是传统的 Transformer

赞(4)ToyToy架构 阅读(187)