30B大模型在树莓派实时运行,AI边缘计算新突破
ByteShape团队通过Shapelearn比特长度学习方法,优化Qwen3-30B模型,使其在树莓派5上达到8.03 TPS实时响应(94.18%质量),并在Intel CPU和Nvidia GPU上显著优于竞品。文章详细分析内存约束下...
标签索引 / 第 2 页
这个标签下有 18 篇文章。按时间回看相关判断与实践记录。
标签精选
ByteShape团队通过Shapelearn比特长度学习方法,优化Qwen3-30B模型,使其在树莓派5上达到8.03 TPS实时响应(94.18%质量),并在Intel CPU和Nvidia GPU上显著优于竞品。文章详细分析内存约束下...
文章指出,大型语言模型(LLM)虽能自动化任务、生成代码并辅助调试,但存在幻觉、偏见等局限性,需工程师仔细审查输出。依赖AI可能导致解决问题能力退化,尤其面对创新问题时时。作者呼吁工程师专注理解解决方案的“为什么”,而非仅追求“什么”,以维...
英特尔在CES 2026上发布酷睿Ultra Series 3处理器,这是首款采用美国本土制造18A先进制程的AI PC平台。新处理器包含X9和X7系列,最高配备16核CPU、12核Xe GPU和50 TOPS NPU,相比前代产品多线程性...
Agentastic.dev 是一款专为 Mac 设计的原生编程 IDE,支持同时运行多个 AI 编码代理,包括 Claude Code、Codex、Gemini 等。它利用 Git worktree 创建隔离工作区,避免代码冲突,内置差异...
Hacker News上的热门讨论文章’AGI Is Here’引发广泛争议。文章假设2021年研究者看到2026年AI模型会惊叹AGI已实现,但评论区观点纷呈。技术专家指出,当前LLM只是2021年模型的增强版,存...
回顾AMD 50年前通过反向工程Intel 8080克隆体进入CPU市场的历史事件,揭示了芯片行业早期竞争格局。文章引发了对x86指令集架构(ISA)开源可能性的深入讨论,有评论指出,将x86子集开源会导致兼容性问题,建议创建新的现代ISA...
本文分享了一个名为CCW的AI驱动软件开发工作流,专为解决大型代码库中的功能新增和调试问题。该工作流结合多模型协作,包括Claude、Gemini等AI工具,通过需求分析、蓝图规划、任务排序和执行流程,显著提升开发效率。作者详细介绍了如何在...
知名性能分析专家Brendan Gregg宣布离开英特尔,结束了其在该公司3.5年的任职。在英特尔期间,Gregg开发了开源的AI火焰图,创建了GPU亚秒级偏移热图,并在eBPF技术委员会担任领导角色,展现了其在性能分析领域的深厚造诣。他特...