跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

实时动态 / 第 870 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
08-29
本页
20 条
累计
26,320 条

深度解析Lisp技术史:新书《Lisp之天才》探寻编程语言的极致之美

作者Cees de Groot推出了新书《The Genius Of Lisp》,深入探讨了计算史上最具影响力的编程语言之一——Lisp的发展历史。该书不仅是技术编年史,更被誉为学术杰作,涵盖了该语言在早期AI研究中的核心地位。书中提供了配套的源代码、可交互的参考文献以及勘误表。目前该书的纸质版和电子版已在Amazon、Lulu等平台...

阅读全文

首次实现:Rust异步编程Async/Await成功登陆GPU

VectorWare宣布在GPU上成功运行Rust的Future trait和async/await语法。传统GPU编程依赖数据并行或手动管理Warp,既困难又易错;而现有的JAX、Triton等方案则需要学习特定的DSL。VectorWare通过将Rust的零成本抽象引入GPU内核,成功复用了现有的异步生态,并移植了嵌入式Execu...

阅读全文

深度解析国际象棋引擎的“怪异”训练法:LLM研究者的宝贵启示

本文探讨了现代国际象棋引擎(如lc0)采用的非常规训练技术,揭示了其与大模型(LLM)研究的深刻联系。文章指出,一旦具备强大搜索能力的引擎存在,昂贵的强化学习(RL)训练可被“蒸馏”替代,验证了搜索算力的极高价值。更具启发的是,利用SPSA算法进行的黑盒优化,允许开发者无视梯度,直接依据“获胜”目标微调神经网络权重甚至C++代码。这种...

阅读全文

AI 安全实战:挑战通过邮件对 AI 助理实施间接提示词注入

HackMyClaw 是一项极具教育意义的 AI 安全实战挑战,旨在揭示大语言模型(LLM)在现实应用场景中的安全漏洞。玩家需要通过电子邮件向名为 Fiu 的 AI 助手发送内容,尝试利用“间接提示词注入”技术,诱导该 AI 违背指令并泄露机密。该项目灵感来源于真实的漏洞研究,生动展示了当 AI 接入邮件等非受信数据源时,极易遭受数据...

阅读全文

揭秘AI中转乱象:二手平台上的Claude竟被“偷梁换柱”成国产模型?

近日,有技术社区用户爆料称,在二手交易市场(如闲鱼)购买所谓的“Claude Code 4.6”中转服务时,遭遇了严重的“货不对板”问题。据反馈,部分商家利用信息差,将后台实际请求路由至成本更低的智谱GLM-4.7等国产模型,以此通过差价牟利。这一现象揭示了目前第三方AI API中转市场的混乱现状,用户在寻求低成本接入顶尖模型的同时,...

阅读全文

Anthropic 发布 Claude Sonnet 4.6:全面强化智能体与编码能力,价格不变

Anthropic 正式推出 Claude Sonnet 4.6 模型,宣布对模型核心技能进行全方位升级。此次更新重点强化了编码效率、计算机交互操作、长文本推理能力以及最为关键的智能体规划功能,旨在显著提升知识工作和设计类任务的处理质量。值得注意的是,尽管模型能力大幅增强,Anthropic 承诺维持原有价格不变。这一举措不仅增强了 ...

阅读全文

构建 AI 编程“流水线”:oh-my-opencode 多智能体架构实战指南

本文深入剖析了 AI 编码工具 oh-my-opencode 的多智能体集群架构设计。该系统通过将复杂的编程任务拆解为规划、检索与执行三个维度,利用 Sisyphus(主控)、Prometheus(战略规划)、Hephaestus(长周期执行)等不同职能的 AI Agent 协作,实现了“让最合适的模型处理最擅长的任务”。文章不仅详细...

阅读全文

AI写作的“平庸陷阱”:为何过度优化会导致“语义消融”与思想降维?

本文提出了“语义消融”(Semantic Ablation)这一概念,深刻剖析了AI写作变得平庸、乏味甚至危险的根源。与产生虚假信息的“幻觉”不同,语义消融是指算法为了追求统计概率最大化,在RLHF(人类反馈强化学习)的作用下,系统性地剥离文本中高熵、独特且精确的信息。文章将这一过程拆解为“隐喻清洗”、“词汇扁平化”和“结构崩塌”三个...

阅读全文

赛博斗蛐蛐实测:五款国产大模型博弈论对决,Qwen-3.5展现顶级逻辑计算能力

一位技术博主模拟了游戏《弥留之际的爱丽丝》中的天平游戏,让Qwen-3.5、GLM-4、Kimi、豆包及DS-3.2五款主流AI大模型进行厮杀。在激烈的博弈对局中,Qwen-3.5表现最为惊艳,在决胜局通过精确计算各种可能性,成功预判并利用规则完成了对GLM-4的“绝杀”;相比之下,GLM-4在绝境中则出现了逻辑混乱与“胡言乱语”。这...

阅读全文

Grok 4.20 Beta 惊艳实测:精准识别模型参数,主动溯源原始论文

近日,科技社区 Linux.do 有用户分享了 Grok 4.20 Beta 的实测表现。在测试中,用户仅要求查询表格中开源模型的参数规模,Grok 不仅准确识别了所有模型的参数量,更令人惊喜的是,它在未被明确指示的情况下,主动挖掘出了该表格的原始论文出处。这一表现显示出 Grok 在复杂语义理解、多模态数据处理以及学术文献溯源方面的...

阅读全文

Grok搜索能力大升级:多Agent架构实测表现惊艳

据科技社区用户反馈,Grok最新版本在搜索能力上取得重大突破,其引入的Multi-Agent(多智能体)协同能力备受瞩目。实测显示,新版Grok在处理复杂搜索任务时速度更快、准确率显著提高,能够一次性解决此前GPT-4思维链模型及其他大模型难以攻克的难题。这一进步表明,xAI在提升AI实际效用方面正迅速发力,通过架构创新而非仅靠参数堆...

阅读全文

开发者探讨如何实现Claude规划与Codex编码的混合协作

文章探讨了一个当前AI开发领域的热门痛点:如何结合不同大模型的优势以构建更高效的Agent。作者通过实际体验指出,Claude模型在任务规划能力上表现优异,而Codex(代指代码生成类模型)在具体编写代码方面更胜一筹。然而,受限于两者不同的API传输协议,目前实现模型协作的方案往往需要通过代理中转,体验较差且不稳定。这一技术探讨折射出...

阅读全文

摆脱外部向量库:如何在SQLite中利用汉明距离实现高效混合搜索

本文介绍了一种在SQLite中实现混合语义搜索的创新方案。作者通过编写C语言扩展,引入汉明距离函数来计算二进制嵌入向量的相似度,成功将FTS5全文搜索(BM25)与语义检索相结合。在Apple M4芯片上的实测显示,利用现代CPU的popcount指令,检索100万行向量数据仅需约28毫秒,且无需依赖Pinecone等外部向量数据库。...

阅读全文

Gemini实测:Pro模型搜索可靠,Thinking与Fast竟生成虚假链接

针对Google Gemini不同模型的搜索能力测试显示,Pro、Thinking和Fast模型在联网表现上存在显著差异。在同样的搜索提示词下,Pro模型能提供真实可跳转的信源;而Thinking和Fast模型不仅来源数量少,还普遍出现“幻觉”,生成了无法跳转的虚假链接。此外,测试发现复杂的自然语言指令往往难以触发搜索,而简单的“搜索...

阅读全文

AI时代的身份撕裂:当“编写代码”不再是程序员的信仰

本文深刻剖析了在AI大模型(LLM)席卷行业的背景下,资深程序员所面临的群体性文化危机。作者感叹,编程文化已从对逻辑与技艺的追求,异化为追逐“资本效率”或依赖AI生成的“赌博式”开发。这种转变导致注重工匠精神的开发者感到被边缘化,并最终失去了“程序员”这一核心身份认同。

阅读全文

因限制军用用途,五角大楼威胁将Anthropic列入供应链黑名单

五角大楼正计划切断与AI公司Anthropic的合作,并将其标记为“供应链风险”,以此迫使所有美国军方承包商与其断交。此前,Anthropic因对军方使用AI模型的方式设置限制(特别是在武器和战场作战领域)而引发高层不满。官员警告称,Anthropic将为此“付出代价”。这一冲突标志着美国军方与顶尖AI实验室在技术军事化应用上的矛盾已...

阅读全文

Kilo Code 推出优化版编程模型:利用测试时扩展技术,免费对标 Cursor

Kilo Code 宣布与一家美国顶尖 AI 实验室达成合作,重新推出并优化了其热门编程模型“Grok Code Fast 1”,且继续免费提供。新模型并非原版的简单回归,而是引入了“测试时扩展”技术。该技术能根据任务需求动态调整运算资源,在处理简单任务时追求极速,在面对复杂逻辑时则提供更深层的智能表现。这一举措显示 Kilo 正试图...

阅读全文

编程的终结?探讨AI编译器与“自然语言源代码”的未来愿景

Linux.do社区的一篇帖文引发了关于软件开发未来的深刻畅想。发帖者提出了“AI编译器”的概念,即未来的软件开发将不再依赖具体的编程语言,而是直接以自然语言作为“源代码”。开发者只需通过与AI进行多轮对话明确需求,生成的自然语言文档可由不同的AI模型(如GPT、GLM等)直接编译成可运行的应用程序,且维护与Bug修复仅需修改自然语言...

阅读全文