Mac用户福音:利用Ollama搭建本地翻译模型,实现沉浸式离线翻译
本文详细介绍了一种在 macOS 上通过 Ollama 部署本地大语言模型的方法,旨在为“沉浸式翻译”插件提供离线支持。教程涵盖了从安装 Ollama、拉取 translategemma 模型,到利用 Modelfile 将上下文长度扩展至...
标签索引 / 第 2 页
这个标签下有 71 篇文章。按时间回看相关判断与实践记录。
标签精选
本文详细介绍了一种在 macOS 上通过 Ollama 部署本地大语言模型的方法,旨在为“沉浸式翻译”插件提供离线支持。教程涵盖了从安装 Ollama、拉取 translategemma 模型,到利用 Modelfile 将上下文长度扩展至...
本文记录了一次在10小时无网络航班上的极限开发实验。作者使用搭载M5 Max芯片和128GB内存的MacBook Pro,本地运行Gemma 4和Qwen大模型,完成了数据分析工具构建及400万Token的代码处理。测试表明,虽然顶级硬件足...
本文深入分析了在消费级平台上使用两张 RTX 4090 显卡部署本地大模型的性能表现。尽管 RTX 4090 自身拥有高达 1008 GB/s 的显存带宽,但其 PCIe 4.0 x16 接口仅有约 31.5 GB/s 的单向带宽,这构成了...
有开发者提议为技术社区 Linux.do 开发一款油猴插件,旨在利用本地运行的 AI 模型,在用户发布回复或话题前自动检测内容是否违反社区准则。该功能的核心优势在于“本地化”,通过调用本地 LLM(大语言模型),既保证了审核的隐私性,又能有...
随着云端API资源收紧,本地大模型部署备受关注。一项针对M1版MacBook Pro与64GB内存Windows笔记本的性能对比显示,后者在缺乏独立显存支持时表现拉胯,而Mac虽仅32GB内存,却凭借“统一内存架构”实现了CPU与GPU的高...
开源项目 Koharu 是一款基于 Rust 语言开发的本地化漫画翻译工具,目前在 GitHub 已获得超过 4000 颗星。该项目展现了极高的技术集成度,内部采用了 DAG 流水线架构,整合了目标检测、基于视觉大模型(LLM)的 OCR、...
本文通过对比 M1 Pro MacBook Pro 与 M4 Max Mac Studio 的实际跑分,深入剖析了苹果芯片在本地部署大模型时的性能表现与使用价值。作者不仅展示了不同代际芯片在算力上的差异,更探讨了在云端 AI 盛行的当下,本...
一位开发者尝试将本地多模态大模型Qwen-VL(8B参数)接入OpenClaw框架,旨在对比其与云端GPT-5在图像识别任务中的表现。实测发现,尽管在独立插件中表现良好,但在Agent框架内,本地模型却遭遇了严重的技术瓶颈:未能正确调用技能...
一位社区网友突发奇想,询问 AI 助手 Kimi 能否仅凭 1 万元启动资金建立一人公司。Kimi 提供了万元级工作站配置建议,并评估了在该硬件上运行 OpenClaw 及本地大模型的可行性。Kimi 认为虽然理论上可行,但面临诸多挑战,最...
随着AI的普及,用户在享受便利的同时日益关注数据隐私。针对“如何在不上传数据的前提下翻译和总结多年私密聊天记录”的需求,技术社区提出的解决方案是转向“本地部署大模型”。通过使用 Ollama 等工具在本地运行开源模型(如 Llama 3),...