深度解析Lisp技术史:新书《Lisp之天才》探寻编程语言的极致之美
作者Cees de Groot推出了新书《The Genius Of Lisp》,深入探讨了计算史上最具影响力的编程语言之一——Lisp的发展历史。该书不仅是技术编年史,更被誉为学术杰作,涵盖了该语言在早期AI研究中的核心地位。书中提供了配套的源代码、可交互的参考文献以及勘误表。目前该书的纸质版和电子版已在Amazon、Lulu等平台...
阅读全文实时动态 / 第 870 页
追踪 AI、开源与工程领域的重要动态。
作者Cees de Groot推出了新书《The Genius Of Lisp》,深入探讨了计算史上最具影响力的编程语言之一——Lisp的发展历史。该书不仅是技术编年史,更被誉为学术杰作,涵盖了该语言在早期AI研究中的核心地位。书中提供了配套的源代码、可交互的参考文献以及勘误表。目前该书的纸质版和电子版已在Amazon、Lulu等平台...
阅读全文VectorWare宣布在GPU上成功运行Rust的Future trait和async/await语法。传统GPU编程依赖数据并行或手动管理Warp,既困难又易错;而现有的JAX、Triton等方案则需要学习特定的DSL。VectorWare通过将Rust的零成本抽象引入GPU内核,成功复用了现有的异步生态,并移植了嵌入式Execu...
阅读全文本文探讨了现代国际象棋引擎(如lc0)采用的非常规训练技术,揭示了其与大模型(LLM)研究的深刻联系。文章指出,一旦具备强大搜索能力的引擎存在,昂贵的强化学习(RL)训练可被“蒸馏”替代,验证了搜索算力的极高价值。更具启发的是,利用SPSA算法进行的黑盒优化,允许开发者无视梯度,直接依据“获胜”目标微调神经网络权重甚至C++代码。这种...
阅读全文HackMyClaw 是一项极具教育意义的 AI 安全实战挑战,旨在揭示大语言模型(LLM)在现实应用场景中的安全漏洞。玩家需要通过电子邮件向名为 Fiu 的 AI 助手发送内容,尝试利用“间接提示词注入”技术,诱导该 AI 违背指令并泄露机密。该项目灵感来源于真实的漏洞研究,生动展示了当 AI 接入邮件等非受信数据源时,极易遭受数据...
阅读全文近日,有技术社区用户爆料称,在二手交易市场(如闲鱼)购买所谓的“Claude Code 4.6”中转服务时,遭遇了严重的“货不对板”问题。据反馈,部分商家利用信息差,将后台实际请求路由至成本更低的智谱GLM-4.7等国产模型,以此通过差价牟利。这一现象揭示了目前第三方AI API中转市场的混乱现状,用户在寻求低成本接入顶尖模型的同时,...
阅读全文Anthropic 正式推出 Claude Sonnet 4.6 模型,宣布对模型核心技能进行全方位升级。此次更新重点强化了编码效率、计算机交互操作、长文本推理能力以及最为关键的智能体规划功能,旨在显著提升知识工作和设计类任务的处理质量。值得注意的是,尽管模型能力大幅增强,Anthropic 承诺维持原有价格不变。这一举措不仅增强了 ...
阅读全文本文深入剖析了 AI 编码工具 oh-my-opencode 的多智能体集群架构设计。该系统通过将复杂的编程任务拆解为规划、检索与执行三个维度,利用 Sisyphus(主控)、Prometheus(战略规划)、Hephaestus(长周期执行)等不同职能的 AI Agent 协作,实现了“让最合适的模型处理最擅长的任务”。文章不仅详细...
阅读全文据社区反馈,Google 似乎已对 Gemini 3.1 Pro 开启了灰度测试。用户无需切换模型,只需使用特定的“Needle”(大海捞针)测试提示词即可验证。数据显示,旧版 Gemini 3.0 Pro Preview 在该测试中的得分通常仅为 23% 至 27%,而新版 3.1 Pro 的得分能稳定超过 40%。这表明 Goog...
阅读全文本文提出了“语义消融”(Semantic Ablation)这一概念,深刻剖析了AI写作变得平庸、乏味甚至危险的根源。与产生虚假信息的“幻觉”不同,语义消融是指算法为了追求统计概率最大化,在RLHF(人类反馈强化学习)的作用下,系统性地剥离文本中高熵、独特且精确的信息。文章将这一过程拆解为“隐喻清洗”、“词汇扁平化”和“结构崩塌”三个...
阅读全文一位技术博主模拟了游戏《弥留之际的爱丽丝》中的天平游戏,让Qwen-3.5、GLM-4、Kimi、豆包及DS-3.2五款主流AI大模型进行厮杀。在激烈的博弈对局中,Qwen-3.5表现最为惊艳,在决胜局通过精确计算各种可能性,成功预判并利用规则完成了对GLM-4的“绝杀”;相比之下,GLM-4在绝境中则出现了逻辑混乱与“胡言乱语”。这...
阅读全文近日,科技社区 Linux.do 有用户分享了 Grok 4.20 Beta 的实测表现。在测试中,用户仅要求查询表格中开源模型的参数规模,Grok 不仅准确识别了所有模型的参数量,更令人惊喜的是,它在未被明确指示的情况下,主动挖掘出了该表格的原始论文出处。这一表现显示出 Grok 在复杂语义理解、多模态数据处理以及学术文献溯源方面的...
阅读全文据科技社区用户反馈,Grok最新版本在搜索能力上取得重大突破,其引入的Multi-Agent(多智能体)协同能力备受瞩目。实测显示,新版Grok在处理复杂搜索任务时速度更快、准确率显著提高,能够一次性解决此前GPT-4思维链模型及其他大模型难以攻克的难题。这一进步表明,xAI在提升AI实际效用方面正迅速发力,通过架构创新而非仅靠参数堆...
阅读全文文章探讨了一个当前AI开发领域的热门痛点:如何结合不同大模型的优势以构建更高效的Agent。作者通过实际体验指出,Claude模型在任务规划能力上表现优异,而Codex(代指代码生成类模型)在具体编写代码方面更胜一筹。然而,受限于两者不同的API传输协议,目前实现模型协作的方案往往需要通过代理中转,体验较差且不稳定。这一技术探讨折射出...
阅读全文本文介绍了一种在SQLite中实现混合语义搜索的创新方案。作者通过编写C语言扩展,引入汉明距离函数来计算二进制嵌入向量的相似度,成功将FTS5全文搜索(BM25)与语义检索相结合。在Apple M4芯片上的实测显示,利用现代CPU的popcount指令,检索100万行向量数据仅需约28毫秒,且无需依赖Pinecone等外部向量数据库。...
阅读全文EasyClaw 推出了一款专为 Windows 用户设计的 OpenClaw 封装工具,主打“零配置”与一键安装。不同于传统的 AI Agent 项目需要复杂的 Docker 或 Python 环境,EasyClaw 极大地降低了技术门槛,提供了安全的本地桌面代理服务。用户不仅能利用 AI 自动化操作本地应用程序,甚至可以通过 Wh...
阅读全文针对Google Gemini不同模型的搜索能力测试显示,Pro、Thinking和Fast模型在联网表现上存在显著差异。在同样的搜索提示词下,Pro模型能提供真实可跳转的信源;而Thinking和Fast模型不仅来源数量少,还普遍出现“幻觉”,生成了无法跳转的虚假链接。此外,测试发现复杂的自然语言指令往往难以触发搜索,而简单的“搜索...
阅读全文本文深刻剖析了在AI大模型(LLM)席卷行业的背景下,资深程序员所面临的群体性文化危机。作者感叹,编程文化已从对逻辑与技艺的追求,异化为追逐“资本效率”或依赖AI生成的“赌博式”开发。这种转变导致注重工匠精神的开发者感到被边缘化,并最终失去了“程序员”这一核心身份认同。
阅读全文五角大楼正计划切断与AI公司Anthropic的合作,并将其标记为“供应链风险”,以此迫使所有美国军方承包商与其断交。此前,Anthropic因对军方使用AI模型的方式设置限制(特别是在武器和战场作战领域)而引发高层不满。官员警告称,Anthropic将为此“付出代价”。这一冲突标志着美国军方与顶尖AI实验室在技术军事化应用上的矛盾已...
阅读全文Kilo Code 宣布与一家美国顶尖 AI 实验室达成合作,重新推出并优化了其热门编程模型“Grok Code Fast 1”,且继续免费提供。新模型并非原版的简单回归,而是引入了“测试时扩展”技术。该技术能根据任务需求动态调整运算资源,在处理简单任务时追求极速,在面对复杂逻辑时则提供更深层的智能表现。这一举措显示 Kilo 正试图...
阅读全文Linux.do社区的一篇帖文引发了关于软件开发未来的深刻畅想。发帖者提出了“AI编译器”的概念,即未来的软件开发将不再依赖具体的编程语言,而是直接以自然语言作为“源代码”。开发者只需通过与AI进行多轮对话明确需求,生成的自然语言文档可由不同的AI模型(如GPT、GLM等)直接编译成可运行的应用程序,且维护与Bug修复仅需修改自然语言...
阅读全文