Ollama Pro实测:国产模型GLM深夜仍遇“龟速”,算力调度与计费遭质疑
有科技爱好者反馈,在订阅 Ollama Pro 服务并尝试运行国产开源大模型(如 GLM-4 系列)时,遭遇了严重的性能瓶颈。尽管用户试图利用时差,“错峰”在夜间使用以避开美国的高峰期,但实际体验中推理速率依然极低,生成少量 Token 往...
标签索引
这个标签下有 3 篇文章。按时间回看相关判断与实践记录。
标签精选
有科技爱好者反馈,在订阅 Ollama Pro 服务并尝试运行国产开源大模型(如 GLM-4 系列)时,遭遇了严重的性能瓶颈。尽管用户试图利用时差,“错峰”在夜间使用以避开美国的高峰期,但实际体验中推理速率依然极低,生成少量 Token 往...
一款名为 StoryBeat-Board 的开源项目近日在 GitHub 上发布。该工具基于经典编剧书籍《救猫咪》的理论框架,利用 GLM-4 模型的 iFlow 智能体能力开发。它允许用户通过拖拽自由排列剧情节点,并利用正负极概念直观展示...
本文分享了一位开发者结合Claude Code与GLM-4进行Java开发的实战经验。受相关技术文章启发,作者通过构建特定的“Claude规约”和技能列表,将AI角色化定位。其核心方法论在于建立“AI生成-人工审查-更新规约”的闭环工作流:...