DeepSeek被曝悄然上线原生多模态能力,突破传统OCR限制
近日,科技社区有用户在测试DeepSeek APP时发现,该模型似乎已悄然解锁了原生多模态能力。此前,DeepSeek在处理图片时主要局限于OCR(光学字符识别)文字提取,而最新的测试显示,原有的“只能识别文字”限制提示已消失。用户在APP...
近日,科技社区有用户在测试DeepSeek APP时发现,该模型似乎已悄然解锁了原生多模态能力。此前,DeepSeek在处理图片时主要局限于OCR(光学字符识别)文字提取,而最新的测试显示,原有的“只能识别文字”限制提示已消失。用户在APP...
文章报道了Waymo自动驾驶车辆在奥斯汀多次未能正确避让校车,甚至在其红灯闪烁时违规通过的事件。尽管Waymo发布了软件召回并与当地学区合作,专门组织了校车停车灯的数据采集活动以辅助训练,但违规通过现象仍未杜绝。专家指出,AI在识别闪烁灯光...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
针对Claude和ChatGPT自带项目库容量有限且需手动上传文档的痛点,开发者推出了本地知识库产品Linkly AI。该工具利用MCP协议与隧道功能,将本地数万份文档通过OAuth认证直接接入云端AI模型。用户只需在本地下载或修改Mark...
近期,谷歌大语言模型Gemini遭到社区用户广泛吐槽。大量反馈显示,Gemini不仅出现“降智”现象,更表现出前所未有的“懒惰”。具体表现为拒绝执行联网搜索任务、懒得提供具体举例,而是通过堆砌无意义语料和过度赞美用户来敷衍作答。这一现象引发...
随着大模型技术爆发,各类评测榜单层出不穷,导致用户难以分辨模型真实实力。本文汇总了目前业内公认最可信的四大AI评测基准,包括关注质量与性价比的 Artificial Analysis、侧重高难度未见任务的 LiveBench、中文权威的 S...
本文探讨了“免费”策略对用户行为及产品认知的扭曲,特别聚焦于AI领域。由于AI工具往往免费,用户倾向于无差别尝试,导致“参与度”数据充满噪音,开发者极易将其误判为“真实需求”。文章指出,当下的核心挑战并非扩大曝光,而是过滤“假阳性”信号,精...
全新轻量级 AI 对话与网关桌面客户端 AQBot 近日完成重大功能更新并开源。该软件基于 Tauri 框架和 Rust 语言开发,主打高性能与极小安装体积。新版本已实现知识库挂载、对话记忆管理、多模型同时回答以及对话压缩等核心功能。作为一...
随着生成式 AI 的普及,互联网中 AI 生成内容的占比正呈指数级增长,引发了业界对“模型崩塌”现象的深切担忧。技术上,若模型持续使用合成数据进行自我迭代,其性能将不可避免地出现退化。更深层的问题在于,AI 极大地降低了内容创作门槛,可能导...
在 AI 对话中,模型常因无法感知当前时间而产生“时间穿越”幻觉,导致回答日期错误。过去,用户往往需要编写复杂的提示词(如“现实锚点”)来强制模型纠正时间观。近日,有用户发现谷歌 AI Studio(GAS)已效仿 Chatbox 等工具,...
OpenAI宣布收购专注于AI领域的新闻媒体TBPN,这一消息在科技社区引发了轩然大波。许多用户对此表示震惊,甚至误以为这是迟到的“愚人节玩笑”。评论区的核心争议在于:一方面,OpenAI正面临Anthropic在企业服务市场的激烈竞争,此...