TeleChat3开源:国产千亿大模型,完全昇腾算力训练
中国电信人工智能研究院开源星辰语义大模型TeleChat3系列,包含国内首个全国产化训练的千亿参数细粒度MoE模型TeleChat3-105B-A4.7B-Thinking及稠密架构模型TeleChat3-36B-Thinking。该系列完...
中国电信人工智能研究院开源星辰语义大模型TeleChat3系列,包含国内首个全国产化训练的千亿参数细粒度MoE模型TeleChat3-105B-A4.7B-Thinking及稠密架构模型TeleChat3-36B-Thinking。该系列完...
一名本硕双985非科班应届生,已获大厂Java后端开发Offer,但技术基础薄弱,面试侥幸通过。实习经历涉及AI Agent开发,对方向感兴趣。当前纠结于是利用空窗期死磕AI技术冲风口,还是先稳住Java饭碗补基础。文章反映了行业转型中的职...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
DeepDiagram是一款基于多智能体的开源可视化工具,专为开发者设计。它能自动处理混乱数据,生成可编辑的ECharts配置和Mermaid语法代码,支持柱状图、折线图、序列图等多种图表类型。工具采用React 19、FastAPI和La...

TL;DR 哥,新年快乐!这周咱们不仅跨了个年,还跨过了一个 AI 时代的门槛。 本周(2025.12.28 – 2026.01.04)虽然有假期buff,但几大巨头都没闲着。最大的体感是:AI 正在从“手里的铲子”进化成“带项...
作者分享了一个名为Alice-Single的开源AI Agent项目,完全通过自然语言开发完成。作者不懂代码,利用AI辅助构建了智能体,技术栈包括Rust TUI、Python后端和Docker容器。作为第二版,项目虽有小问题但基本可用。此...
本文探讨了AI在团队开发中的痛点,提出通过OpenSpec规范构建结构化知识体系,实现人机协同迭代开发。通过初始化知识目录、引入Change-Driven流程,AI从“项目小白”成长为“业务伙伴”。实践显示,该方法显性化隐性知识,降低新成员...
一位拥有后端基础和实习经验的技术人员,因对后端发展局限和薪资差距的担忧,计划转向大模型开发领域。他寻求学习路径和项目实践建议,以提升春招竞争力。分享了对AI职业转型的思考,讨论了大模型开发的技能需求和行业趋势。 原文链接:Linux.do

TL;DR LLM的知识有截止日期,RAG让它能查最新资料;LLM只会聊天,Agent让它能干活。RAG的核心是检索+生成,文档分块策略直接影响效果;Agent的核心是感知+规划+记忆+工具,ReAct架构让它能像人一样思考和行动。本文从8...

大模型面试100问:从基础到实战的完整指南 为什么需要这个系列? 大模型面试不是背八股文——面试官要的是系统性理解和实战经验。市面上的面试题要么太碎片化(100个孤立问题),要么太理论化(只讲公式不讲应用)。 这个系列不一样: ✅ 系统化:...
一位开发者分享了使用Claude Code进行项目的实际经验,包括token消耗快、生成代码与预期偏差等问题。他尝试了plan模式拆解任务和spec-workflow执行,但效果不理想,项目虽能运行却感觉不完善。未来计划探索让AI架构项目结...