深入浅出大模型基石:从 jieba 分词看文本表示的算法演进
本文源自 Datawhale 开源项目,系统梳理了自然语言处理(NLP)的底层逻辑——文本表示与分词技术。文章以经典的 jieba 库为例,深入浅出地讲解了基于词典构建有向无环图(DAG)及利用动态规划寻找最大概率路径的算法原理,并剖析了隐...
标签索引 / 第 121 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
本文源自 Datawhale 开源项目,系统梳理了自然语言处理(NLP)的底层逻辑——文本表示与分词技术。文章以经典的 jieba 库为例,深入浅出地讲解了基于词典构建有向无环图(DAG)及利用动态规划寻找最大概率路径的算法原理,并剖析了隐...
阿里巴巴通义千问团队推出了全新的Qwen3.5 Medium系列模型,包含35B及122B等版本。令人瞩目的是,这些开源模型在基准测试中表现超越了OpenAI GPT-5-mini和Anthropic Claude Sonnet 4.5。该...
针对LLM在创意写作领域的应用难点,该项目在GitHub上建立了一份高质量的精选资源列表,收录了2022年以来关于故事、小说及剧本生成的129项相关研究。与简单的链接堆砌不同,作者对链接进行了严格校验,并从技术维度细分出故事规划、多智能体协...
本文提出了一种名为“验证规格驱动开发(VSDD)”的AI原生软件工程方法论。VSDD将规格驱动(SDD)、测试驱动(TDD)和验证驱动(VDD)融合为统一的AI编排流程。该方法论利用Claude等模型构建代码,同时引入由Gemini扮演的“...
针对传统 RAG 难以处理长周期状态变化和叙事脉络的痛点,作者开源了基于 LangGraph 的 Agentic RAG 项目 narrarc。该项目将聊天记录视为有状态的叙事节点,通过双层索引和多步推理机制,实现了对复杂时间跨度问题的精准...
“Now I Get It”是一款旨在打破科学知识壁垒的AI工具。用户只需上传科学论文PDF,系统即可利用大模型技术将其转化为可分享的交互式网页,并用通俗语言解释复杂概念。该工具支持即时生成,并提供Token消耗与成本估算,对于研究人员和科...
本文基于80万次高并发API调用的实测数据,对比了DeepSeek、火山引擎、Gemini、豆包等主流大模型在数据编码任务中的表现。结果显示,DeepSeek V3.2 凭借95%的准确率和极低的缓存成本断层领先,成为T0级选择;火山引擎因...
本话题源于开发者社区的真实探讨,聚焦于AI辅助编程中的高效工作流选择。面对复杂任务,开发者面临两难选择:是在同一个对话中持续探讨并执行,还是先让AI总结生成文档,再开启新对话读取执行?讨论重点分析了长上下文对输出质量的影响、信息压缩导致的细...
针对当前 AI 智能体普遍存在的“失忆”与上下文瓶颈问题,本文分享了一套基于 OpenClaw 的双层记忆架构方案。作者设计了“热缓存+深度存储”体系,通过分层查找与语义搜索互补,确保高效信息检索。其核心价值在于引入“程序职员”工作流,将 ...
本文分享了三个基于 Python 和 Node.js 的实战自动化项目,包括利用 Claude API 实现 X (Twitter) 舆情实时监控与情感分析、通过飞书机器人自动聚合 SaaS 核心指标,以及基于 Playwright 的电商...