可视化的语言奥秘:一万高频词如何互相定义
这是一个极具创意的数据可视化实验,旨在探索英语语言结构的深层关联。项目选取了谷歌万亿词库中最常用的10,000个英语单词,基于Open English Wordnet的释义数据,构建了一个庞大的力导向图。该图谱直观地展示了单词之间如何相互定...
标签索引 / 第 3 页
这个标签下有 38 篇文章。按时间回看相关判断与实践记录。
标签精选
这是一个极具创意的数据可视化实验,旨在探索英语语言结构的深层关联。项目选取了谷歌万亿词库中最常用的10,000个英语单词,基于Open English Wordnet的释义数据,构建了一个庞大的力导向图。该图谱直观地展示了单词之间如何相互定...
本文源自 Datawhale 开源项目,系统梳理了自然语言处理(NLP)的底层逻辑——文本表示与分词技术。文章以经典的 jieba 库为例,深入浅出地讲解了基于词典构建有向无环图(DAG)及利用动态规划寻找最大概率路径的算法原理,并剖析了隐...
文章介绍了一种针对猜词游戏Semantle的高效算法求解器。Semantle基于Google News word2vec向量计算语义相似度,人类玩家往往需要数十次尝试才能通过“语义导航”逼近答案。作者开发的求解器放弃了人类的直观逻辑,转而利...
Linux.do社区的一篇帖文引发了关于软件开发未来的深刻畅想。发帖者提出了“AI编译器”的概念,即未来的软件开发将不再依赖具体的编程语言,而是直接以自然语言作为“源代码”。开发者只需通过与AI进行多轮对话明确需求,生成的自然语言文档可由不...
针对传统待办事项工具录入成本高、操作繁琐的痛点,开发者推出了名为“Todo AI”的智能助手。该产品摒弃了复杂的表单填写,利用 AI 技术直接解析自然语言指令,自动提取时间、标题及优先级等关键信息生成任务。此外,系统支持基于 SSE 的流式...
针对代码频繁变更导致文档过时的难题,Falconer公司提出“LLM-as-a-Courtroom”新架构,利用多智能体协作解决LLM决策不可靠的问题。该系统模拟法庭审判流程:公诉人负责构建证据链,辩护律师进行反驳,陪审团独立投票,法官最终...
本文深入浅出地解释了Word2vec算法背后的数学原理,特别是“国王-男人+女人=女王”这一经典类比为何成立。文章从词共现和分布假说出发,阐述了点互信息(PMI)与向量压缩的关系,展示了如何利用向量空间模型进行语义推理。此外,作者还探讨了线...
Magic CSV是一款基于AI的创新工具,用户只需上传CSV文件并输入自然语言指令(如’split address into street, city, state, zip’或’standardize...
在Linux.do论坛上,用户分享了一项引人注目的测试:选中所有卡片后生成的新对话,传入了高达18万字符的文本。令人惊叹的是,哈基米3 Pro设备完美处理了这一任务,展现了其强大的AI处理能力。用户特别强调谷歌的上下文技术非常出色,这凸显了...
本文作者分享了两次尝试让AI复刻特定文风的失败经历:一次是模仿政策公文风格,另一次是模仿个人博客风格。AI输出内容无法使用,因为它只会抄袭和套用素材,无法根据新话题自行适应和创新,即使添加了禁止套用、要求思考创新的提示词。这揭示了当前AI在...