跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

实时动态 / 第 901 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
08-30
本页
20 条
累计
26,372 条

“一股GPT-5味”?DeepSeek新模型引爆社区热议:长文本惊艳但幻觉仍存

近日,DeepSeek发布的新模型在技术论坛引发轰动。有开发者测试后表示,其智能程度令人惊叹,不仅拥有百万级上下文窗口,在长文本创作(如小说生成)方面表现出色,甚至让人产生“看到了GPT-5”的错觉。然而,多位参与者也指出,该模型目前仍存在较为严重的幻觉问题,逻辑推理的稳定性尚待提升。这场讨论既体现了开源大模型的惊人进步,也暴露了通向...

阅读全文

离线状态下Gemini竟精准识人,数据隐私与“赛博永生”引热议

近日,在开发者社区Linux.do上有用户反馈,Google的AI模型Gemini在未开启联网搜索的情况下,竟然能够精准识别出用户的身份背景,除了个别细节(如RVC项目)外描述几乎完全正确。这一现象让当事人感到惊讶,并引发了关于“赛博永生”的调侃。该事件揭示了当前大模型在训练数据中对个人隐私信息的深度记忆能力,再次引发了技术界对于AI...

阅读全文

实测遇冷:Antigrability 上下文窗口疑似缩水,200k 即触达上限

近日,有开发者在技术社区反馈,AI 编程工具 Antigrability 在处理长文本任务时存在上下文限制问题。经用户实测,当对话或代码累积的上下文长度接近 200k 时,系统便会强制报错,提示 “prompt is too long”,要求用户执行压缩或清除操作。这一发现与市场对超长上下文模型的普遍预期存在落差,引发了社区对 Ant...

阅读全文

开源 OpenClaw 插件发布:无缝接入 OpenCode 免费模型,支持 Kimi

该项目名为 'opencode-to-openai',旨在作为原生插件将 OpenCode 的模型生态(如 Kimi k2.5-free)直接集成到 OpenClaw 环境中。用户只需执行简单的终端命令即可完成安装与重启,并自动同步模型列表。插件注重安全性与灵活性,默认禁用本地工具调用以防风险,同时支持调试模式。这一工具降低了开发者在...

阅读全文

编译器神话破灭?GCC和Clang在简单代码中竟生成低效汇编

这篇文章深入探讨了C++主流编译器GCC和Clang在处理简单数组全零检查时的反常表现。作者通过GodBolt编译器探索工具发现,在开启最高优化级别(-O3)后,两款编译器针对不同数组大小生成的汇编代码均存在效率低下或逻辑冗余的问题。例如,GCC在处理单个整数时使用了非直观的指令序列,而Clang则执行了不必要的栈空间写入操作。这一发...

阅读全文

让 AI 当市长接管模拟城市:开发者构建基于 REST API 的 LLM 游戏沙盒

这是一个原本失控的周末黑客项目,作者最初尝试让 Claude 运行 SNES 版《模拟城市》未果,转而基于开源引擎 Micropolis 开发了一个无头城市模拟平台。该项目利用 Cloudflare Durable Objects 托管模拟引擎,允许任何人无需注册即可获取 API 密钥,指挥 AI 智能体担任“市长”管理城市。虽然观察...

阅读全文

实测DeepSeek回答一致性堪忧:同一问题答案随机,被指像“随机生成器”

近日,技术社区Linux.do上有用户发现,热门AI模型DeepSeek在回答特定问题时存在严重的随机性缺陷。针对“linuxdo是什么”这一固定问题,DeepSeek每次生成的回答均不相同,内容差异巨大。这一现象引发了社区对于模型“幻觉”问题的担忧,认为其更像是一个随机生成器而非精准的问答助手。虽然DeepSeek近期在推理能力上备...

阅读全文

开源效率工具:一键备份 Linux.do 至 Notion,集成 AI 助手管理知识库

一款名为 LD-Notion 的开源脚本,通过浏览器插件安装,解决了将 Linux.do 论坛收藏批量导出至 Notion 并保留原格式(代码、表格、图片)的痛点。其核心亮点在于深度集成了 AI 助手,支持接入 OpenAI、Claude 等大模型。用户不仅能在论坛和笔记页面直接通过自然语言搜索、分类、翻译内容,还能指挥 AI 自动操...

阅读全文

国产大模型正面硬刚:GLM 5.0与MiniMax 2.5同日发布,AI竞争进入白热化

国内大模型赛道今日迎来“神仙打架”,智谱AI(GLM)与MiniMax几乎在同一时间发布了最新一代产品。据社区讨论,GLM 5.0已正式上线,而MiniMax也迅速推出了2.5版本,并重点展示了其Agent(智能体)相关能力。两大头部厂商选择在同一天“硬碰硬”,不仅体现了国产AI技术的极速迭代,也预示着行业竞争焦点正从基础模型训练转向...

阅读全文

DeepSeek实测曝光:疑似支持100万token上下文,成功通过“大海捞针”挑战

社区用户通过上传约3MB的测试数据,对DeepSeek APP端模型进行了极限测试。测试结果显示,该模型疑似已支持100万token的超长上下文窗口,并成功通过了严苛的“大海捞针”测试,能够精准定位并提取隐藏在超长文本中的关键信息。这一发现若属实,意味着DeepSeek在长文本处理能力上已跻身全球顶尖水平,标志着国产大模型在超长上下文...

阅读全文

高二学生新作:iOS/watchOS大模型客户端公测,集成MCP与快捷指令

一位高二学生历时四个月开发的Apple平台AI客户端“ETOS-LLM-Studio”正式开启公测。该应用专为iOS和watchOS设计,不仅具备基础的聊天功能,还创新性地集成了MCP(模型上下文协议)、长期记忆及“世界书”功能,并支持AI调用iOS快捷指令。最引人注目的是,公测期间项目方联合社区资源,免费提供了Gemini 2.5 ...

阅读全文

开源新工具:将MySQL执行计划可视化为交互式火焰图

针对MySQL数据库性能调优难题,一款GitHub开源项目提供了创新的解决方案。该工具能够将传统的文本式查询执行计划转换为直观的交互式火焰图。这种可视化方式有效解决了传统表格展示难以直观体现耗时层级的问题,帮助开发者和DBA快速定位慢查询中的“热点”与瓶颈,显著提升了SQL语句分析与数据库索引优化的效率。

阅读全文

开源神器 Itsyhome:在 macOS 菜单栏流畅管理 130+ 个 HomeKit 设备

开发者 Nick 发布了名为 Itsyhome 的开源 macOS 菜单栏应用,旨在解决官方 Home 应用在管理海量设备时过于臃肿的问题。该应用支持完整的 HomeKit 控制,利用 Mac Catalyst 与 AppKit 混合架构提供原生体验。项目完全开源,基础功能免费,Pro 版提供摄像头和自动化支持,还包含 CLI 工具和...

阅读全文

告别无效打码:专家揭秘模糊算法的逆向漏洞,原图竟可完美还原

本文深入探讨了图像模糊算法的安全隐患,指出常见的移动平均模糊本质上是一种可逆的线性变换。作者通过数学推导证明,即使面对高强度的模糊处理,攻击者也能利用相邻像素的关联性,逆向推导并完美还原出原始图像的细节。实验表明,即便是经过JPEG压缩的模糊图片,其核心信息依然可以被恢复。这一发现对当前的隐私保护实践提出了警示:简单的“打码”或模糊处...

阅读全文

OpenAI 试水“裂变”获客:ChatGPT Plus 推出免费赠礼功能

OpenAI 似乎正在向部分用户推广 ChatGPT Plus 的“礼赠”功能,允许现有用户通过专属链接向好友或家人免费赠送一个月的 Plus 会员试用资格。这一举措被业界视为 OpenAI 加速用户增长的策略转变,试图通过社交分享扩大其付费订阅的受众群。然而,这也引发了市场的担忧,鉴于过去此类邀请机制常被滥用,可能会催生大量低价“黑...

阅读全文

DeepSeek新版本引发热议:社区实测显示逻辑推理能力显著增强

科技社区近期热议DeepSeek疑似发布新版本。多位用户反馈,针对此前模型难以解答的复杂逻辑测试问题,新版本已能轻松攻克,显示出明显的智商跃升。这一迹象表明,DeepSeek在模型迭代上进展迅速,其代码生成与数学推理等核心能力可能迎来了新一轮优化,再次引发了业界对国产大模型竞争力的高度关注。

阅读全文

DeepSeek网页端疑似更新:泄露系统提示词显示支持百万上下文并严防“越狱”

近日,有用户在Linux.do论坛分享了DeepSeek网页端疑似更新的系统提示词。内容显示,DeepSeek自称最新模型,知识截止日期标注为2025年5月,并确认支持100万上下文窗口及多种格式文件上传。最引人注目的是,该提示词包含极严格的“硬约束层”,明令禁止模型建立拟人化亲密关系(如禁止使用“老婆”、“亲爱的”等称呼),并对情感...

阅读全文

开发者实测:Codex 指令遵循能力不及 Claude Code,自主性过强导致流程失控

一位开发者在 V2EX 上分享了使用 Codex(5.3-codex-high)与 Claude Code 的实战体验。尽管在提示词中明确设置了“完成工作后确认”的指令,Codex 仍经常无视流程直接全盘执行;即便切换至计划模式,它也会跳过“将计划写入文档”的步骤直接开始写代码。该开发者认为,在指令遵循性和工作流控制方面,Claude...

阅读全文

DeepSeek 新模型灰度实测:百万级上下文窗口,一口气“吞下”《三体》三部曲

据 V2EX 社区用户反馈,DeepSeek App 端疑似已开启新模型灰度测试。实测表明,该模型拥有高达 1M(百万级别)的上下文窗口长度,能够一次性处理约 70 万字文本,相当于完整收录《三体》三部曲并精准回忆细节,这将极大提升超长文档分析与长对话记忆的体验。此外,该模型知识库更新至 2025 年 5 月,能准确识别特定时间节点(...

阅读全文