释放 M 系列芯片潜能:开发者用原生 Swift 打造 KataGo 客户端,实现极致本地 AI 体验
近日,一位技术爱好者为了充分发挥 Apple Silicon 的硬件性能,使用原生 Swift 语言开发了一款内置 KataGo 引擎的围棋客户端。该应用通过底层优化,能够高效调用 M 系列芯片的 GPU 资源,在本地实现了流畅的 AI 对...
标签索引 / 第 3 页
这个标签下有 100 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,一位技术爱好者为了充分发挥 Apple Silicon 的硬件性能,使用原生 Swift 语言开发了一款内置 KataGo 引擎的围棋客户端。该应用通过底层优化,能够高效调用 M 系列芯片的 GPU 资源,在本地实现了流畅的 AI 对...
本文详细测评了 Orange Pi 6 Plus 单板计算机,重点展示了其在 AI 与 NPU(神经网络处理单元)方面的硬件革新。作为一款搭载 ARM 架构的高性能开发板,它不仅具备优秀的 Linux 兼容性,更通过集成的专用 AI 加速芯...
面对云服务器昂贵的价格与资源限制,一项名为“Colo”的创新服务提供了新思路:将你的旧笔记本托管到专业数据中心。该服务与Hetzner合作,仅需每月7欧元,就能提供比入门级VPS更强的CPU、内存和存储性能,且包含独立IPv4和KVM访问权...
一款名为“飞书语音消息技能”的开源工具引发关注。该项目巧妙利用微软 Edge 浏览器的 TTS 接口,将文字实时转换为逼真语音并直接推送至飞书,无需任何付费 API 密钥。其最大的亮点在于极低的资源占用,即使是树莓派等低功耗设备也能流畅运行...
一项关于分布式 AI 硬件的构想引发了社区关注。该设想提出开发一款类似路由器的迷你 PC,用户购买设备后可获得本地算力(如 8G 显存)。通过互联网,所有购买该设备的用户将互联互通,形成一个分布式的算力网络,共同支撑运行像 120B 这样的...
Gemma Gem 是一款基于 WebGPU 技术的 Chrome 浏览器扩展,将谷歌最新的 Gemma 4 模型直接嵌入浏览器端运行。该工具完全无需 API 密钥或云端支持,确保用户数据不离开本地设备。除了基础的问答功能,它还具备强大的 ...
一位技术极客利用谷歌的TurboQuant KV压缩技术,成功在十年前的Tesla K80显卡上运行了Qwen 3.5 9b大模型。在LLM.cpp的魔改版本加持下,这块老旧显卡不仅跑起了256k超长上下文的模型,还完成了Q4km量化。尽管...
欧洲AI初创公司Pruna.ai发布了一款开源模型压缩工具,旨在解决AI绘画模型体积庞大、运行缓慢的痛点。实测表明,经其压缩的模型可在亚秒级时间内生成图像,输出WebP格式文件大小仅为36KB,却拥有1.5K画面的质感与细节。该技术不仅显著...
开发者近日在 GitHub 上发布了 TurboQuant-WASM 项目,旨在利用 WebAssembly (WASM) 技术,将 Google 的高性能矢量量化算法成功移植到浏览器环境中。矢量量化是 AI 模型压缩的关键技术,能显著降低...
该项目是一款名为Apfel的开源工具,旨在释放Mac电脑内置的硬件潜能,无需额外付费即可提供AI服务。在云端AI成本日益高昂的背景下,Apfel利用Mac本地的处理器(如M系列芯片)进行模型推理,为用户提供零成本且隐私安全的本地智能体验。这...