传闻称GPT-6即将发布:性能暴涨40%,支持2M上下文
近日,科技社区 Linux.do 及社交媒体 X 上传出关于 GPT-6 即将发布的消息。据多方爆料,OpenAI 的新一代模型 GPT-6 可能带来显著性能提升,号称较 GPT-4 性能暴涨 40%,实现全面碾压式超越。此外,传闻称该模型...
标签索引 / 第 6 页
这个标签下有 190 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,科技社区 Linux.do 及社交媒体 X 上传出关于 GPT-6 即将发布的消息。据多方爆料,OpenAI 的新一代模型 GPT-6 可能带来显著性能提升,号称较 GPT-4 性能暴涨 40%,实现全面碾压式超越。此外,传闻称该模型...
近日,社区网友在 DeepSeek 网页端源码中发现了疑似新功能的踪迹,显示平台可能正在测试“专家模式”和“快速模式”。挖掘信息显示,“专家模式”目前似乎隐藏在代码编写场景中,暗示其将调用更强的推理能力以应对复杂任务,而“快速模式”则可能用...
开发者发布了一款名为LLM_OCR的开源工具,旨在利用多模态大语言模型(LLM)实现高性能的文本识别。相较于传统OCR软件,该项目在准确率和复杂排版处理上表现更优。该工具支持PDF及主流图片格式直接上传,并提供Markdown、Word、T...
近日,科技社区有用户在测试DeepSeek APP时发现,该模型似乎已悄然解锁了原生多模态能力。此前,DeepSeek在处理图片时主要局限于OCR(光学字符识别)文字提取,而最新的测试显示,原有的“只能识别文字”限制提示已消失。用户在APP...
SeedDance 2.0 正式发布,定位为集AI视频与图像生成于一体的一站式聚合平台。该产品接入了目前行业内主流的多个生成式模型,打通了“文生图、图生图、文生视频、图生视频”的全链路创作流程。相比于分散使用单一工具,SeedDance 旨...
Google DeepMind 正式发布了 Gemma 4 系列开放模型,宣称其为“字节级最强”的开源模型。该模型基于与 Gemini 相同的研究和技术构建,专为高级推理和智能体工作流量身打造。Gemma 4 具备强大的多模态能力,支持文本...
Google DeepMind 正式推出 Gemma 4 系列模型,以“真开源、全模态”为核心卖点。该系列完全采用 Apache 2.0 协议,不仅具备领先的视觉与视频理解能力,其 2B 和 4B 的小参数版本更首次在端侧实现了原生音频输入...
本文记录了作者与网友围绕 Minimax 2.7(M2.7)是否具备原生多模态能力展开的技术辩论。网友因在 OpenClaw 中调用 M2.7 成功识别图片,便认定模型原生支持视觉;而作者通过查阅官方文档及测试工具调用日志,论证这实际上是接...
据科技社区消息,谷歌疑似正在 LMSYS Chatbot Arena 上测试其新一代开源模型 Gemma 4。该模型目前以“significant-otter”为代号进行秘密测试,被网友敏锐捕捉。据透露,Gemma 4 可能将包含 2B(2...
本文分享了一位创作者完全依赖 AI 工具从零制作音乐 MV 的实操案例。作者采用 Gemini 2.5 Pro 担任“创意总监”统筹全局,利用 GLM-4.5 生成歌词并配合 Suno 4.5 Pro 制作音乐,视频画面则通过 Google...