企业AI落地实战:自研RAG遇阻,为何最终选定DeepSeek-Qwen蒸馏版模型?
一位技术负责人分享了公司AI模型落地的实战经历。在尝试自研基于RAG架构的POC(概念验证)后,发现全流程自研涉及向量库维护与数据清洗,工作量过于庞大。随后考察了成熟开源方案MaxKB,虽功能完善但存在付费墙限制。在经过多轮测试至凌晨3点后...
标签索引
这个标签下有 4 篇文章。按时间回看相关判断与实践记录。
标签精选
一位技术负责人分享了公司AI模型落地的实战经历。在尝试自研基于RAG架构的POC(概念验证)后,发现全流程自研涉及向量库维护与数据清洗,工作量过于庞大。随后考察了成熟开源方案MaxKB,虽功能完善但存在付费墙限制。在经过多轮测试至凌晨3点后...
随着大模型技术向垂直行业渗透,企业在开发内部专用Agent时面临架构选型的两难困境。一方面,通用开源Agent功能庞杂,包含大量与特定业务无关的冗余代码,可能影响效率;另一方面,完全从零开发虽然能精准匹配需求,但研发成本过高且容易重复造轮子...
在企业AI基建落地过程中,如何将内部庞大且复杂的业务框架、开发规范及约束逻辑转化为一线人员可直接调用的AI“技能”,成为技术团队面临的新挑战。某公司AI部门正尝试利用Trellis工作流文档,通过AI技术进行结构化整理,旨在构建符合公司“世...
某传统企业技术团队分享了内部落地 AI Agent 的真实经历。团队利用 Elastic 和 Dify 构建了文档检索与故障排查类 Agent,但在推进过程中遭遇双重打击。出于数据安全考量,企业无法调用外部 API,转而部署 DeepSee...