实测 Gemini 3.1 Pro:视觉与逻辑能力显著增强,但推理速度仍需优化
来自 Linux.do 社区的最新实测显示,疑似 Gemini 3.1 Pro 的模型在视觉与逻辑推理上取得显著突破。其优势在于“思考”长度明显增加,SVG 生成、图像识别(如魔方、手写、人物全识别)能力大幅提升,且代码能力(如《我的世界》...
标签索引 / 第 79 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
来自 Linux.do 社区的最新实测显示,疑似 Gemini 3.1 Pro 的模型在视觉与逻辑推理上取得显著突破。其优势在于“思考”长度明显增加,SVG 生成、图像识别(如魔方、手写、人物全识别)能力大幅提升,且代码能力(如《我的世界》...
本文探讨了非技术人员如何利用 Anthropic 的 Claude Code 工具,通过简单的自然语言指令实现工作与生活的自动化。文章指出,大多数人使用 AI 工具失败的原因并非技术门槛,而是缺乏对需求的清晰定义。作者提出了一套“四步工作法...
在近日举行的印度人工智能峰会上,OpenAI CEO山姆·奥特曼与Anthropic CEO达里奥·阿莫迪上演了一场极具象征意味的“微表情大戏”。尽管在印度总理莫迪的合影环节,两人作为当前通用人工智能(AGI)领域最顶尖的竞对代表被安排在一...
本次评测基于真实医学场景,对比了DeepSeek、Qwen及Gemini系列模型在1M长上下文下的表现。测试让各模型基于50篇文献摘要撰写综述,结果显示DeepSeek凭借新技术在生成质量和连贯性上表现最佳,有效提升了注意力机制;Qwen-...
发表在《自然》杂志上的一项最新研究揭示了社交媒体算法对政治观点的巨大影响力。研究显示,从按时间排序切换到X平台(前Twitter)算法推荐流后,用户关注共和党议题(如通胀、移民)的概率上升了4.7%,反对对特朗普调查的概率增加了5.5%。更...
一位社区用户在对比测试中发现,针对同一份PDF文档的知识问答,Google推出的NotebookLM在回答准确度上显著优于通用大模型Gemini。Gemini被指出现回答混乱、甚至“瞎编”的现象,暴露了其直接处理文档资料时RAG(检索增强生...
AI公司Zyphra正式开源了专注于脑电(EEG)数据处理的3.8亿参数基础模型ZUNA。该模型能够从嘈杂、不完整的脑电信号中重建高质量数据,并能预测缺失的电极通道,其表现远超球面样条插值等传统方法。ZUNA基于208个EEG数据集和200...
随着 AI 工具的普及,软件与内容的开发成本趋近于零,导致海量同质化产品涌现,使得“创造力”不再稀缺,而“注意力”成为极度昂贵的资源。文章指出,过去“努力”是筛选产品的过滤器,如今的信息洪流让新产品的冷启动变得异常艰难。资深开发者感叹,在现...
Anthropic 首席执行官 Dario Amodei 在印度班加罗尔开发者大会上发表演讲,正式宣布印度已成为 Anthropic 的全球第二大市场。Amodei 高度评价了印度的技术人才,称其拥有“技术卓越的国民基因”。会上最引人注目的...
该项目展示了如何利用 Claude Code 自动生成交互式的科普内容,涵盖扩散模型、傅里叶变换、标度律以及大语言模型原理等硬核科技话题。与传统的图文教程不同,这些解释器允许用户通过“玩”的方式直观理解数学和计算机科学背后的逻辑。这不仅体现...