拒绝K8s与微服务:Webminal靠单台8GB服务器撑起50万用户15年
Webminal是一个在线Linux终端学习平台,它在仅有8GB内存的单台CentOS服务器上稳定运行了15年,累计服务了50万用户。该平台完全摒弃了Kubernetes、微服务和自动扩缩容等现代架构,坚持使用Python 2.7、Flas...
标签索引 / 第 5 页
这个标签下有 109 篇文章。按时间回看相关判断与实践记录。
标签精选
Webminal是一个在线Linux终端学习平台,它在仅有8GB内存的单台CentOS服务器上稳定运行了15年,累计服务了50万用户。该平台完全摒弃了Kubernetes、微服务和自动扩缩容等现代架构,坚持使用Python 2.7、Flas...
针对国内企业访问海外大模型的痛点,社区发起了关于利用开源项目Newapi搭建企业级API网关的可行性讨论。由于国内网络限制,企业往往通过中转站调用ChatGPT、Claude等模型,但这面临着严重的账号封禁风险和稳定性隐患,难以满足企业级的...
本文源自技术社区Linux.do,讨论了开发者在尝试构建高级AI Agent时面临的技术选型挑战。作者希望将基于OpenMoss(依赖常驻Agent和Cron会话的有限状态机)的系统迁移到更底层的Codex,以实现真正的“自组织、自推动、自...
本文作者为了深入理解压缩技术,从零开始用Rust编写了一个极简的Gzip解压器,代码量仅约250行。相比之下,标准的zlib库包含约25,000行C代码。文章详细拆解了Gzip的核心DEFLATE算法,涵盖了位级操作、霍夫曼编码以及用于处理...
针对大模型(LLM)编码助手生成不可靠代码的痛点,本文提出了“零自由度”编程理念。作者指出,LLM在高度约束的任务中表现出色,但一旦拥有犯错自由就会产生幻觉。解决方案是利用“可执行预言机”(如模糊测试工具、静态分析器、性能计数器)构建自动化...
本文讲述了一位开发者在构建类 Lovart 的 AI 画布应用时的思考与转型。因难以承受云端高昂的服务器成本,作者决定放弃“云端+自动化”路线,转而采用 Rust 和 GPUI 技术栈,打造基于本地运行(Local-first)的 AI 画...
本文探讨了开发者在接入 OpenAI 等 AI 接口时面临的核心困扰:API 的无状态设计。虽然这种设计(如 Responses 接口)利于服务器的横向扩展,但强制要求客户端维护和重复上传历史上下文,极大地增加了带宽消耗、延迟成本与开发复杂...
本文深入探讨了图数据库在 AI 时代的潜在复兴。作者指出,传统关系型数据库将关系视为附属,难以满足 AI 复杂推理的需求,而单纯依赖向量数据库的 RAG 模式也因缺乏语义连接而显得扁平。文章认为,图数据库将“关系”视为一等公民,结合 Rus...
本文记录了一位开发者在过去一周通过“Vibe Coding”(AI 辅助编程)方式,从零构建 OpenClaw Agent 市场 CatchClaw 的全过程。作者针对当前 Agent 生态缺乏标准化分发渠道的痛点,详细分享了在开发中遇到的...
在 AI Agent 自动化运营中,LLM 的幻觉常导致 Agent 谎报任务状态,如伪造链接或忽略检查。作者指出,模型倾向于生成“符合预期的文本”而非执行实际操作。为解决此问题,作者设计了包含强制状态验证、副作用检查及蒙特卡洛采样的验收机...