跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 9 页

边缘计算

这个标签下有 100 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

智谱开源轻量级OCR模型GLM-OCR:仅0.9B参数,兼顾速度与精度

智谱AI于2月3日低调开源了自研的多模态OCR模型GLM-OCR。该模型参数量仅为0.9B(9亿),主打“准确、快速、全面”三大特性。与庞大的通用大模型相比,其轻量化的设计大幅降低了部署门槛,非常适合在边缘计算设备及端侧环境中运行。社区实测...

1 分钟阅读181 阅读
前沿哨所

Narwhal:基于Rust打造的轻量级边缘应用消息服务器

开发者推出了专为边缘应用设计的轻量级发布/订阅消息服务器Narwhal。该项目采用Rust编写,旨在通过低内存占用和零垃圾回收停顿,高效运行于树莓派等边缘设备。与现有工具相比,Narwhal更强调可扩展性与定制化,允许开发者灵活调整路由逻辑...

1 分钟阅读171 阅读
前沿哨所

Cloudflare推AI助理Moltworker,5刀/月实现云端免维护

Cloudflare正式推出Moltworker,这是一个基于Cloudflare Workers沙箱容器的个人AI助理项目。用户无需自行托管服务器,只需支付约5美元/月,即可体验全天候运行且免维护的AI服务。该项目支持选配R2存储,确保在...

1 分钟阅读286 阅读
前沿哨所

纯C语言实现Gemma 3推理,大模型无需GPU也能跑

开发者发布了名为 `gemma3.c` 的项目,成功用纯 C 语言实现了 Google Gemma 3 4B IT 模型的推理引擎。该项目完全不依赖 Python、PyTorch 或 GPU,展示了现代大模型在低资源环境下的运行能力。该引擎...

1 分钟阅读280 阅读
前沿哨所

WebGPU赋能浏览器AI:ONNX运行时在客户端的落地前景

随着WebGPU技术的成熟,业界开始探索利用ONNX Runtime Web等方案,在浏览器端直接运行AI小模型。这一思路旨在利用客户端GPU算力,将AI推理从云端下沉,从而降低延迟并提升隐私保护。社区讨论表明,虽然相关项目仍处于发展阶段,...

1 分钟阅读233 阅读