微软揭秘Phi-4视觉推理模型:探索多模态智能体的强化学习新范式
微软研究院深度解析了Phi-4-reasoning-vision模型的开发历程,重点分享了在训练具备高级推理能力的多模态模型时的核心技术经验。文章详细探讨了如何利用“代理验证器”结合多模态强化学习技术,显著提升了模型在视觉理解与复杂逻辑推理...
标签索引 / 第 64 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
微软研究院深度解析了Phi-4-reasoning-vision模型的开发历程,重点分享了在训练具备高级推理能力的多模态模型时的核心技术经验。文章详细探讨了如何利用“代理验证器”结合多模态强化学习技术,显著提升了模型在视觉理解与复杂逻辑推理...
有网友在 Linux.do 论坛发帖称,意外发现网页版 Gemini Flash 免费模型在没有额外提示词的情况下,也能展示简单的“思考过程”。虽然 Google 目前主推的 2.0 Flash Thinking 版本才主打深度思考,但这一...
文章通过Google“手气不错”按钮的隐喻,指出LLM虽然能提供看似精准的答案,但剥夺了用户在探索过程中接触争议、谬误和复杂观点的机会。作者认为,智力的成长源于这种“痛苦”的研究体验和对抗不确定性,而LLM往往因过度自信和平均化倾向,提供看...
继上次出现故障后,OpenAI 近日再次为部分用户重置了 API 使用额度。官方人员回应称,重置是因为收到了大量用户关于额度消耗过快的反馈,经确认并非正常使用,而是由 Bug 导致。用户此前在切换至新模型版本后(原文提及 gpt-5.4,可...
近日有开发者实测发现,在申请Claude官方API的试用额度(如此前推广的100美元优惠)时,所使用的邮箱域名类型直接决定了审核效率。数据显示,使用自建域名邮箱(企业邮箱)注册的用户,通常可在几分钟内通过验证并立即获得API访问权限;而使用...
本文探讨了Claude Code(Opus 4.5)对软件开发的深远影响。作者在体验其惊人的编码能力后,意识到这不仅是效率工具的升级,更是团队生态的重塑。AI的介入引发了Marc Andreessen所说的“墨西哥僵局”:工程师、产品经理和...
OpenAI 负责消费硬件与机器人业务的主管 Caitlin Kalinowski 宣布辞职。Kalinowski 此前在 Meta 负责 VR 硬件开发,加入 OpenAI 后领导了公司重返机器人领域的战略布局。作为 OpenAI 具身智...
OpenAI正式启动“Codex for Open Source”项目,旨在为关键开源软件维护者提供支持。该项目通过提供专为维护工作流设计的AI工具,帮助减少代码审查和问题分类的工作量。入选的开发者将获得长达6个月的ChatGPT Pro免...
本文通过作者在“企业版 Facebook”工作的亲身经历揭示了一个令人不安的真相:科技巨头早已记录下我们的一举一动,但过去隐私之所以“安全”,仅仅是因为处理海量日志数据太过繁琐和枯燥。然而,AI 的出现彻底改变了这一局面。正如美国国防部试图...
近日,社区针对AI编程工具Claude Code进行了一场高强度的实战测试。在处理复杂任务时,Claude Code展现了惊人的耐力,连续运行了整整一个小时而未中断。然而,实测数据也暴露出当前技术瓶颈:尽管系统能持续运行,但整体执行速度显得...