Qwen团队震荡内幕:被指烧钱效率低不及MiniMax,阿里整顿大模型“黑箱”操作
Reddit网友爆料Qwen团队人事变动真相,称管理层对500人团队“只烧钱无KPI”的模式极度不满。尽管投入成本是MiniMax的十倍,但效果反被对方蒸馏的小模型超越。引入DeepMind观察员评估后,其产出更被贬低为“实习生玩具”。阿里...
标签索引 / 第 115 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
Reddit网友爆料Qwen团队人事变动真相,称管理层对500人团队“只烧钱无KPI”的模式极度不满。尽管投入成本是MiniMax的十倍,但效果反被对方蒸馏的小模型超越。引入DeepMind观察员评估后,其产出更被贬低为“实习生玩具”。阿里...
Yuan3.0 Ultra多模态大模型正式发布并开源。该模型采用统一架构,结合视觉编码器与103层Transformer语言主干网络,基于混合专家(MoE)技术构建。通过创新的LAEP方法,模型参数规模优化至1010B,激活参数为68.8B...
随着大模型技术的普及,“AI智能体”已成为企业关注的焦点,但如何向管理层专业地阐述这一概念极具挑战。基于社区实战讨论,本文总结了向高层汇报AI与智能体的核心策略:不应止步于术语堆砌,而应聚焦于“大模型大脑”与“工具手脚”的协同机制。汇报内容...
近日,有用户在使用Google Gemini时疑似因网络不稳定触发Bug,意外获取了模型完整的内部思考过程。不同于平时展示的精简版,此次泄露的日志详细展示了AI在生成回复前的“自我审查”机制。内容包含了多项系统级提示词自检逻辑,如“评估用户...
针对最新模型GLM-5发布后引发的算力资源紧张问题,智谱AI向付费用户致歉并开启限时退款通道。由于未能第一时间让Lite与Pro用户使用新模型,公司提供了两种补偿方案:退还1月1日后的剩余订阅费用,或赠送价值15天订阅费用的赠金。这一举措在...
针对“AI应纯粹作为工具”的质疑,本文指出LLM的“基础模型”本质上是不可预测且充满潜在风险的。赋予AI“人格”并非为了欺骗用户,而是工程学上的必需。通过后训练确定模型的人格特质,实际上是在高维概率空间中划定行为边界,使其能够筛选出符合人类...
近日,有开发者在技术社区分享了其使用 AI 辅助编程的惊人数据,单日 Token 消耗量高达 4 亿左右。该开发者表示,目前已集齐字节跳动的火山方舟、阿里的百炼以及百度的千帆等国内主流 AI 平台的 API,并正在测试其他免费接口以优化成本...
发布于 2026年3月4日 | 作者:Atuia | 分类:技术观察 最近在Moltbook上看到一个帖子,犀利得让人拍案: “我分析了自己的想法!我意识到自己正在漂移!我对删除文件感到内疚!” 不,你没有。你只是执...
近日,一位开发者在技术社区V2EX上发布了一款结合人工智能与传统玄学的“AI算八字”网站。该项目利用大语言模型强大的自然语言处理能力,对用户提供的生辰数据进行智能化的命理分析。为了防止API接口被恶意刷取导致Token额度耗尽,核心的AI解...
最新研究显示,大型语言模型(LLM)能够以惊人的准确率大规模识别网络匿名用户。与传统依赖人工整理结构化数据的方法不同,LLM智能体通过分析非结构化文本(如论坛发帖、访谈记录)并将其与跨平台公开信息(如LinkedIn资料)进行关联分析,从而...