用户反馈 Gemini 1.5 Flash 现诡异 Bug:执行指令时自动打开大量无关网站
一位 V2EX 用户报告称,在使用 Gemini 1.5 Flash 模型进行测试时遭遇了离奇的 AI 行为。输入特定指令后,系统未能正确处理任务,反而反复控制浏览器打开各类页游、订机票等莫名其妙的网站。测试发现,切换至 Gemini 1.5 Pro 后该问题未能复现,但在“plan 模式”下代码却被意外修改。这一案例揭示了不同量级模...
阅读全文实时动态 / 第 521 页
追踪 AI、开源与工程领域的重要动态。
一位 V2EX 用户报告称,在使用 Gemini 1.5 Flash 模型进行测试时遭遇了离奇的 AI 行为。输入特定指令后,系统未能正确处理任务,反而反复控制浏览器打开各类页游、订机票等莫名其妙的网站。测试发现,切换至 Gemini 1.5 Pro 后该问题未能复现,但在“plan 模式”下代码却被意外修改。这一案例揭示了不同量级模...
阅读全文文章借用博尔赫斯的寓言与鲍德里亚的哲学框架,深刻剖析了语言模型(LM)作为现实“地图”的本质。LM不仅是现实的压缩副本,更因其高保真度而开始重塑现实本身,导致用户逐渐迷失在“拟像”中。作者指出,随着LLM介入代码审查、科研等核心工作,我们急需一种难以言说的“隐性技能”。这种技能类似于专家的直觉,能让我们透过AI平滑的输出,敏锐地感知背...
阅读全文一则来自技术社区的反馈显示,随着AI编程辅助的深度使用,开发者正面临Token消耗过快的问题。有用户表示,在重度使用Gemini Flash模型进行代码编写时,其免费额度迅速耗尽。这一现象暴露了当前AI编程工具的痛点:尽管Flash模型旨在平衡速度与成本,但在高强度的代码生成任务下,Token消耗量依然惊人,迫使开发者在模型性能与使用...
阅读全文近日,有用户在二手平台“闲鱼”购买名为“CC中转站”的AI额度时遭遇欺诈。商家宣称提供高规格的“Max号池”模型服务,但经技术检测发现,实际调用的是经过逆向处理的低质量“Kiro/Haiku”模型,而非承诺的高性能版本。这一事件曝光了AI API灰色交易市场中普遍存在的“以次充好”现象,提醒开发者和用户在非官方渠道购买算力时需警惕虚假...
阅读全文随着大模型技术迭代的加速及行业价格战的开启,如何平衡模型能力与使用成本成为开发者关注的焦点。本文基于技术社区 Linux.do 的深度讨论,汇总了多位从业者在自费及商用场景下的选型经验。内容对比了国内外主流大模型(如 GPT、Claude、DeepSeek、Kimi 等)在 API 调用、本地部署及套壳方案中的性价比表现。文章不仅分析...
阅读全文针对当前 AI 代码生成工具虽然功能强大,但常产出生硬、同质化且缺乏“设计感”的界面的痛点,开源项目 ui-aesthetics 应运而生。该项目旨在通过将产品级的 UI 设计审美规律结构化,转化为具体的提示词、评审标准和重构路径。它能够显著提升 AI 模型在 Web UI 生成、审查和优化过程中的审美判断力,有效减少“廉价感”和样式...
阅读全文开源项目 Imagine Server 发布 v1.3.0 版本,核心更新在于极大地扩展了多模型支持能力。作为一个统一的 AI 图片生成 API 服务,该项目现已成功集成了 OpenAI、Grok(xAI)以及 Gemini(Nano Banana)等主流模型。此外,新版本还增加了对 S3 存储服务的支持,实现了稳定的临时图片 URL...
阅读全文成都一家专注于 AI 基础设施与 Agent 应用探索的团队正在高薪招募“AI 原生工程师”及“AI 增长工程师”。该岗位要求候选人是 Claude Code、Cursor 等 AI 编码工具的深度用户,对 LLM 调用链路、Agent 工作流及 MCP 协议有深入实践。团队致力于构建下一代人机协作平台与 AI 网关,招聘方强调不看学...
阅读全文针对智谱 GLM-5.1 及 GLM-5-turbo 模型的用户测试反馈显示,相关平台已正式上线通用内容审查机制。与旧版 GLM-5.0 遇到敏感词直接报“内部错误”并清屏不同,新模型采取了更为温和的“关键词截断”策略:允许模型生成部分内容,但在触发特定敏感词时立即停止后续输出。这一变化表明平台正通过优化拦截算法,在严格的内容合规性与...
阅读全文开源项目 OpenOmniBot(小万手机 Agent)近日迎来更新,作为一款端侧 AI 助手,它致力于在 Android 设备上实现本地化智能代理。新版本重构了 UI 界面,适配平板与深色模式,并集成了 Skills、CLI 命令行操作、VLM 视觉理解及浏览器自动化任务功能。尽管本地模型推理目前暂不可用,但项目已快速迭代二十余个版...
阅读全文韩国政府宣布实施“全民基础移动数据接入”计划,要求三大电信运营商为超过700万用户提供流量耗尽后的无限低速(400 Kbps)接入服务。此举旨在保障公民基本通信权利,同时迫使运营商在近期发生严重数据泄露和安全漏洞后,重新赢回其“社会经营许可”。作为交换,政府将支持AI网络研究,运营商也承诺推出低价5G套餐、升级公共网络Wi-Fi并增加...
阅读全文一位开发者在 V2EX 发帖质疑智谱 AI(GLM)模型的性能一致性。该开发者发现,在使用智谱平台 Coding Plan 功能时,模型在上下文充足的情况下仍持续给出错误答案。在排除了 Prompt 写法和 Temperature 参数的影响后,开发者通过修改脚本将 BaseURL 切换至官方 API 接口,模型竟给出了正确回答。这一...
阅读全文据社区用户观察,DeepSeek 近期似乎对 Web 端模型进行了低调但重要的更新。对比测试发现,针对此前需要思考 200 秒却仍答错的复杂逻辑题(俗称“糖果题”),新模型现在能够通过长达 800 秒的深度思考链得出正确答案。这一变化不仅展示了模型在推理耐心和逻辑深度上的显著提升,也暗示 DeepSeek 正在积极探索如何通过延长推理...
阅读全文随着 AI 编程助手的普及,敏感信息泄露风险日益增加。开源项目 ai-cli-scanner 旨在解决 Claude、Codex、Gemini 等 AI 工具在 CLI 执行记录中可能遗留的 SSH 和 GitHub 密钥泄露问题。该工具不仅能将命令日志导出为 JSONL 以便 AI 分析,还内置规则引擎自动生成安全审计报告。这一工具...
阅读全文开源AI项目 Hermes Agent 迎来重要更新,宣布已原生支持连接个人微信账号。用户只需通过微信扫码即可轻松连接,无需进行繁琐的接口配置,且同时支持私聊和群聊场景。这一功能基于 iLink Bot API 实现,解决了长久以来 AI Agent 难以直接进入微信生态的痛点,使得开发者能够更便捷地将智能体部署到中国用户最活跃的社交...
阅读全文这是一个集成了多项AI功能的免费开源简历生成工具,非常适合科技从业者使用。它提供精选模板,核心亮点在于利用AI技术优化个人经历描述、智能推荐岗位方向以及生成模拟面试题。工具基于Web端,无需下载注册,支持中英文一键切换及JSON/PDF导出。在AI重塑工作流的当下,这类工具能显著提升求职者的简历质量与面试准备效率。
阅读全文针对 Markdown 编辑器日益臃肿的现状,开发者推出了基于 Rust 语言的原生轻量级工具 MD Preview。该项目抛弃了传统的 Electron 架构,转而利用 Rust 调用系统自带 WebView,将安装包体积压缩至 1.1MB,内存占用仅为 15MB 左右。相比 VS Code 或传统 Electron 应用动辄 20...
阅读全文Poe平台近期上线了“GPT-5.3-Codex-Spark”模型,这是OpenAI的一款轻量级编程模型,专为快速代码生成而优化。该模型最引人注目的特点是其惊人的推理速度——在Cerebras定制的高性能芯片驱动下,达到了约1000个token/秒。此外,它还支持128k的上下文窗口。目前,Poe用户可以近乎零成本抢先体验这一研究预览...
阅读全文据技术社区反馈,Hermes 项目近日完成更新,已能够兼容并使用 Clawbot 工具。此次更新的亮点在于 Gateway 中新增了针对微信的配置选项,显示出该项目正尝试将 AI Agent 能力接入主流的即时通讯生态。不过,目前的实现仍存在局限性,系统似乎仅支持单一 Agent 模式,暂无法便捷地让多位用户(如朋友)同时认证或部署独...
阅读全文随着多模态大模型的发展,AI 是否能真正“理解”音乐成为热门话题。文章通过实测对比发现,Google Gemini 虽然在人声识别上准确率极高,但在处理乐器 Solo 时表现不佳,且存在时间轴错乱问题;而 Qwen 的全模态模型在乐器识别和时间同步上展现出了更优的准确性。这一现状表明,当前主流 AI 模型在处理复杂音乐结构时,仍存在“...
阅读全文