AI 架构全景图:汇总 DeepSeek、Llama 3 与 Kimi 等主流大模型技术细节
该资源库汇集了当前最前沿的开源大语言模型架构图与详细参数表,由 AI 专家 Sebastian Raschka 整理发布。内容不仅涵盖了 Meta Llama 3、DeepSeek V3/R1、Mistral 等国际主流模型,还重点收录了包...
标签索引 / 第 58 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
该资源库汇集了当前最前沿的开源大语言模型架构图与详细参数表,由 AI 专家 Sebastian Raschka 整理发布。内容不仅涵盖了 Meta Llama 3、DeepSeek V3/R1、Mistral 等国际主流模型,还重点收录了包...
针对仿人机器人难以在高速运动(如网球)中复刻人类动态技能的问题,研究人员推出了LATENT系统。该系统不再依赖难以获取的完美比赛数据,而是仅利用由基础动作片段组成的“不完美”人类运动数据作为先验知识。通过模拟环境中的校正与组合训练,机器人成...
著名技术作家查尔斯·佩佐尔德近日亲测了 Spotify 推出的 AI DJ 功能,原本期待人工智能能修复该平台长期存在的推荐盲点,结果却大失所望。他在文章中犀利地指出,这款 AI 产品的表现简直“愚蠢至极”,这不仅让他对“智能”一词的定义产...
近日,社区分享了一则利用大语言模型(LLM)进行角色扮演游戏的有趣案例。不同于以往大模型输出内容往往显得机械、冗长且缺乏情感,用户通过调整提示词(Prompt),成功让AI演绎出了一版充满“内心吐槽”和幽默对话的《仙剑奇侠传》互动剧情。在该...
据《Popular Science》报道,风靡全球的《Pokémon Go》在过去十年中积累了海量高精度的地理空间数据。玩家为了游戏任务扫描的数百万个“补给点”和“道馆”,实际上构建了一个庞大的视觉定位系统(VPS)。目前,这些数据正被用于...
随着 AI 技术的普及,关于“AI 带来知识平权”的观点甚嚣尘上。然而,这一论断可能存在认知偏差。AI 确实极大地降低了信息获取的门槛,让普通用户也能快速检索到专业领域的答案,实现了“知其然”层面的效率平权。但是,真正的知识在于理解背后的原...
一位计算机科学博士生发起讨论,寻求更高效的学术论文写作方案。虽然Cursor和OpenAI的Prism提供了强大的AI辅助,但如何与学术界主流的协作平台Overleaf无缝集成仍是难题。该研究者反馈现有Overleaf插件不稳定且官方AI功...
近日,针对谷歌Gemini 3.1 Pro模型的社区测试显示,不同接入方式之间存在显著性能差异。排名显示,Google AI Studio效果最佳,其次是CLI(命令行),而被称为“Antigravity”的入口常陷入死循环,体验不佳。令人...
随着大模型技术的爆发,国内外平台和模型版本层出不穷,定价体系日益复杂。AI 开发者在项目选型时,往往需要花费大量时间在多个官网间来回查阅文档,效率极低。为解决这一痛点,有开发者自制了一款极简的聚合检索工具。该工具能够直观展示各家主流大模型的...
最近在科技社区引发了一场关于搜索引擎现状的热烈讨论。有用户指出,过去大家热衷于对比各大搜索引擎的优劣,而随着生成式 AI 的普及,这种行为已显得过时。该观点认为,除了寻找特定软件下载或代码仓库等特定场景外,绝大多数日常的信息查询和知识解答已...