无需代码:利用Markdown和语义文件系统实现大模型持续学习
作者提出了一种极简的解决方案,旨在应对大模型(LLM)在处理持续到达新数据时的长期记忆挑战。该方案无需编写复杂代码,仅利用两个Markdown文件和一个“语义文件系统”,配合Shell命令即可实现高效的语义检索。尽管目前只是初代原型,但作者...
标签索引 / 第 54 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
作者提出了一种极简的解决方案,旨在应对大模型(LLM)在处理持续到达新数据时的长期记忆挑战。该方案无需编写复杂代码,仅利用两个Markdown文件和一个“语义文件系统”,配合Shell命令即可实现高效的语义检索。尽管目前只是初代原型,但作者...
本文作者回顾了自己依靠QBasic、GCC及免费网络文档入门编程的经历,指出开源运动曾极大地降低了技术门槛,让贫富差距大的地区的孩子也能成为开发者。然而,随着LLM和AI Agent的兴起,编程所需的算力成本剧增。作者担忧,无论是本地运行所...
有用户在Kimi Code控制台发现了一款名为“Kimi K2.6-code-preview”的新模型,这表明月之暗面(Moonshot AI)可能正在对其编程类大模型进行迭代升级。尽管目前尚未有官方发布公告,且具体参数和性能提升尚不明确,...
针对科研人员高效管理文献的需求,该项目通过 fork 并优化 ‘open notebook’,实现了将 Zotero 集合一键导入并转化为大模型(LLM)可读的结构化知识库。项目集成了高质量 PDF 转 Markdo...
近日,在知名技术社区 Linux.do 上,多位技术从业者对字节跳动旗下的“豆包”大模型提出了尖锐批评。用户普遍反馈,近期豆包的智能水平似乎出现下滑,具体表现为“幻觉”现象愈发严重,无法准确理解复杂指令。甚至有用户实测发现,在要求依据法条查...
据社区论坛 Linux.do 透露,AI 助手 Kimi(月之暗面)正在内部测试名为 “k2.6-code-preview” 的下一代模型。从命名规则推测,该新版本将专注于编程和代码生成领域的专业能力。目前该模型似乎...
这篇文章深入剖析了现代软件团队的经济逻辑,指出大多数组织对研发成本与产出比缺乏清晰的财务视野。文章以数据为据,指出一个8人工程师团队的月成本极高,且内部平台组往往需要通过3-5倍的价值产出才能覆盖实际风险与维护成本。作者认为,过去十年的低利...
一位网络安全研究员在社区发帖指出,当前主流大模型的安全护栏设置过于严格,导致在进行代码审计、Web漏洞挖掘、Payload构造及CVE复现等研究时,常遭遇“一问就拒”的困境,严重阻碍了安全研究的效率。尽管Anthropic最新的Mythos...
近日,一篇关于“领导要求自研大模型做知识库”的帖子在技术社区引发热议。这一现象折射出当前企业数字化转型中普遍存在的认知误区:管理层往往高估了“从零训练大模型”的性价比,而低估了利用现有技术构建应用的复杂度。讨论指出,对于大多数企业而言,真正...
本文介绍了一种将传统外设与AI大模型结合的创新实践。作者通过在Windows系统下使用“闪电说”接入字节跳动豆包大模型,实现了高精度的语音识别与交互;通过将立式鼠标的侧键映射为语音输入触发器,作者成功将一款价格不足两百元的国产鼠标,改造为具...