跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

实时动态 / 第 521 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
08-18
本页
20 条
累计
25,593 条

用户反馈 Gemini 1.5 Flash 现诡异 Bug:执行指令时自动打开大量无关网站

一位 V2EX 用户报告称,在使用 Gemini 1.5 Flash 模型进行测试时遭遇了离奇的 AI 行为。输入特定指令后,系统未能正确处理任务,反而反复控制浏览器打开各类页游、订机票等莫名其妙的网站。测试发现,切换至 Gemini 1.5 Pro 后该问题未能复现,但在“plan 模式”下代码却被意外修改。这一案例揭示了不同量级模...

阅读全文

当AI地图开始重塑疆域:为何我们需要掌握一种无法被编码的“阅读直觉”?

文章借用博尔赫斯的寓言与鲍德里亚的哲学框架,深刻剖析了语言模型(LM)作为现实“地图”的本质。LM不仅是现实的压缩副本,更因其高保真度而开始重塑现实本身,导致用户逐渐迷失在“拟像”中。作者指出,随着LLM介入代码审查、科研等核心工作,我们急需一种难以言说的“隐性技能”。这种技能类似于专家的直觉,能让我们透过AI平滑的输出,敏锐地感知背...

阅读全文

AI编程的算力焦虑:Gemini Flash额度告急,揭示Token经济下的开发成本困局

一则来自技术社区的反馈显示,随着AI编程辅助的深度使用,开发者正面临Token消耗过快的问题。有用户表示,在重度使用Gemini Flash模型进行代码编写时,其免费额度迅速耗尽。这一现象暴露了当前AI编程工具的痛点:尽管Flash模型旨在平衡速度与成本,但在高强度的代码生成任务下,Token消耗量依然惊人,迫使开发者在模型性能与使用...

阅读全文

揭秘AI API倒卖乱象:二手交易平台频现“模型调包”陷阱

近日,有用户在二手平台“闲鱼”购买名为“CC中转站”的AI额度时遭遇欺诈。商家宣称提供高规格的“Max号池”模型服务,但经技术检测发现,实际调用的是经过逆向处理的低质量“Kiro/Haiku”模型,而非承诺的高性能版本。这一事件曝光了AI API灰色交易市场中普遍存在的“以次充好”现象,提醒开发者和用户在非官方渠道购买算力时需警惕虚假...

阅读全文

寻找高性价比大模型方案:兼顾性能与成本的 AI 实战指南

随着大模型技术迭代的加速及行业价格战的开启,如何平衡模型能力与使用成本成为开发者关注的焦点。本文基于技术社区 Linux.do 的深度讨论,汇总了多位从业者在自费及商用场景下的选型经验。内容对比了国内外主流大模型(如 GPT、Claude、DeepSeek、Kimi 等)在 API 调用、本地部署及套壳方案中的性价比表现。文章不仅分析...

阅读全文

告别廉价“AI味”:开源项目 ui-aesthetics 提升 AI 生成的界面设计质感

针对当前 AI 代码生成工具虽然功能强大,但常产出生硬、同质化且缺乏“设计感”的界面的痛点,开源项目 ui-aesthetics 应运而生。该项目旨在通过将产品级的 UI 设计审美规律结构化,转化为具体的提示词、评审标准和重构路径。它能够显著提升 AI 模型在 Web UI 生成、审查和优化过程中的审美判断力,有效减少“廉价感”和样式...

阅读全文

开源项目Imagine Server更新:统一接入OpenAI、Grok与Gemini绘图API

开源项目 Imagine Server 发布 v1.3.0 版本,核心更新在于极大地扩展了多模型支持能力。作为一个统一的 AI 图片生成 API 服务,该项目现已成功集成了 OpenAI、Grok(xAI)以及 Gemini(Nano Banana)等主流模型。此外,新版本还增加了对 S3 存储服务的支持,实现了稳定的临时图片 URL...

阅读全文

成都AI团队急招Agent工程师:寻找深度使用Claude/Cursor的“原住民”

成都一家专注于 AI 基础设施与 Agent 应用探索的团队正在高薪招募“AI 原生工程师”及“AI 增长工程师”。该岗位要求候选人是 Claude Code、Cursor 等 AI 编码工具的深度用户,对 LLM 调用链路、Agent 工作流及 MCP 协议有深入实践。团队致力于构建下一代人机协作平台与 AI 网关,招聘方强调不看学...

阅读全文

社区反馈:GLM-5.1 模型引入关键词截断机制,平台审查策略转向

针对智谱 GLM-5.1 及 GLM-5-turbo 模型的用户测试反馈显示,相关平台已正式上线通用内容审查机制。与旧版 GLM-5.0 遇到敏感词直接报“内部错误”并清屏不同,新模型采取了更为温和的“关键词截断”策略:允许模型生成部分内容,但在触发特定敏感词时立即停止后续输出。这一变化表明平台正通过优化拦截算法,在严格的内容合规性与...

阅读全文

端侧 AI 助手 OpenOmniBot 迭代:支持 VLM 与终端操作,重塑安卓交互

开源项目 OpenOmniBot(小万手机 Agent)近日迎来更新,作为一款端侧 AI 助手,它致力于在 Android 设备上实现本地化智能代理。新版本重构了 UI 界面,适配平板与深色模式,并集成了 Skills、CLI 命令行操作、VLM 视觉理解及浏览器自动化任务功能。尽管本地模型推理目前暂不可用,但项目已快速迭代二十余个版...

阅读全文

韩国推行“全民基本数据”:流量耗尽后仍可上网,电信巨头被迫以AI基建“赎罪”

韩国政府宣布实施“全民基础移动数据接入”计划,要求三大电信运营商为超过700万用户提供流量耗尽后的无限低速(400 Kbps)接入服务。此举旨在保障公民基本通信权利,同时迫使运营商在近期发生严重数据泄露和安全漏洞后,重新赢回其“社会经营许可”。作为交换,政府将支持AI网络研究,运营商也承诺推出低价5G套餐、升级公共网络Wi-Fi并增加...

阅读全文

智谱 AI 被指模型“缩水”?实测揭示官方 API 与平台版性能差异

一位开发者在 V2EX 发帖质疑智谱 AI(GLM)模型的性能一致性。该开发者发现,在使用智谱平台 Coding Plan 功能时,模型在上下文充足的情况下仍持续给出错误答案。在排除了 Prompt 写法和 Temperature 参数的影响后,开发者通过修改脚本将 BaseURL 切换至官方 API 接口,模型竟给出了正确回答。这一...

阅读全文

DeepSeek Web模型悄然进化:推理时长翻倍,攻克此前难解的逻辑题

据社区用户观察,DeepSeek 近期似乎对 Web 端模型进行了低调但重要的更新。对比测试发现,针对此前需要思考 200 秒却仍答错的复杂逻辑题(俗称“糖果题”),新模型现在能够通过长达 800 秒的深度思考链得出正确答案。这一变化不仅展示了模型在推理耐心和逻辑深度上的显著提升,也暗示 DeepSeek 正在积极探索如何通过延长推理...

阅读全文

无需中转,Hermes Agent 实现原生接入个人微信

开源AI项目 Hermes Agent 迎来重要更新,宣布已原生支持连接个人微信账号。用户只需通过微信扫码即可轻松连接,无需进行繁琐的接口配置,且同时支持私聊和群聊场景。这一功能基于 iLink Bot API 实现,解决了长久以来 AI Agent 难以直接进入微信生态的痛点,使得开发者能够更便捷地将智能体部署到中国用户最活跃的社交...

阅读全文

求职季利器:这款GitHub开源简历工具集成AI优化与模拟面试

这是一个集成了多项AI功能的免费开源简历生成工具,非常适合科技从业者使用。它提供精选模板,核心亮点在于利用AI技术优化个人经历描述、智能推荐岗位方向以及生成模拟面试题。工具基于Web端,无需下载注册,支持中英文一键切换及JSON/PDF导出。在AI重塑工作流的当下,这类工具能显著提升求职者的简历质量与面试准备效率。

阅读全文

告别臃肿 Electron:仅 1MB 的 Rust 超轻量 Markdown 预览工具

针对 Markdown 编辑器日益臃肿的现状,开发者推出了基于 Rust 语言的原生轻量级工具 MD Preview。该项目抛弃了传统的 Electron 架构,转而利用 Rust 调用系统自带 WebView,将安装包体积压缩至 1.1MB,内存占用仅为 15MB 左右。相比 VS Code 或传统 Electron 应用动辄 20...

阅读全文

每秒千tokens!Poe上线Cerebras芯片驱动的新款代码模型GPT-5.3-Spark

Poe平台近期上线了“GPT-5.3-Codex-Spark”模型,这是OpenAI的一款轻量级编程模型,专为快速代码生成而优化。该模型最引人注目的特点是其惊人的推理速度——在Cerebras定制的高性能芯片驱动下,达到了约1000个token/秒。此外,它还支持128k的上下文窗口。目前,Poe用户可以近乎零成本抢先体验这一研究预览...

阅读全文

技术追踪:Hermes 接入 Clawbot 并新增微信网关配置,AI Agent 本地化应用加速

据技术社区反馈,Hermes 项目近日完成更新,已能够兼容并使用 Clawbot 工具。此次更新的亮点在于 Gateway 中新增了针对微信的配置选项,显示出该项目正尝试将 AI Agent 能力接入主流的即时通讯生态。不过,目前的实现仍存在局限性,系统似乎仅支持单一 Agent 模式,暂无法便捷地让多位用户(如朋友)同时认证或部署独...

阅读全文

真的懂音乐吗?实测 Gemini 与 Qwen 的多模态音频解析能力

随着多模态大模型的发展,AI 是否能真正“理解”音乐成为热门话题。文章通过实测对比发现,Google Gemini 虽然在人声识别上准确率极高,但在处理乐器 Solo 时表现不佳,且存在时间轴错乱问题;而 Qwen 的全模态模型在乐器识别和时间同步上展现出了更优的准确性。这一现状表明,当前主流 AI 模型在处理复杂音乐结构时,仍存在“...

阅读全文