Google I/O 2026 的真正主线:不是模型大战,而是 Google 把 Gemini 变成生态内核
本文整理自灵姐说AI对 Google I/O 2026 的深度解读。比起逐条数发布会功能,更值得看的是一个更大的判断:OpenAI 正在做超级 App,而 Google 想把 Gemini 塞进搜索、Workspace、YouTube、An...
标签索引 / 第 7 页
这个标签下有 2410 篇文章。按时间回看相关判断与实践记录。
标签精选
本文整理自灵姐说AI对 Google I/O 2026 的深度解读。比起逐条数发布会功能,更值得看的是一个更大的判断:OpenAI 正在做超级 App,而 Google 想把 Gemini 塞进搜索、Workspace、YouTube、An...
Transformer 刚出来时,很多人把注意力都放在 self-attention 上。那当然没错,因为它确实重新定义了模型怎么看上下文。但如果只盯着 attention,你会漏掉另一个同样关键的问题:模型怎么知道词序? 这是我看完这期视...
自然语言天生有歧义。 "The detective followed the spy with binoculars." 这句话有两个完全合理的理解:侦探拿着望远镜跟踪间谍,或者间谍带着望远镜刚好被侦探跟上了。人脑能瞬间意识到两种可能,但早...
本文整理自张小珺 Podcast 对姚顺宇的访谈。这篇文章不再按访谈流水账复述,而是重新整理成一条更清楚的主线:当头部模型能力逐渐趋同后,大模型竞争为何会从天才叙事,转向组织能力、产品定义和长期执行。原视频:https://www.yout...
过去语言大模型(LLM)因基于概率预测字符,常在 10+11 等基础计算中出错。但随着 Agent(智能体)范式的引入,这一难题正被攻克。在 Agent 逻辑下,模型能识别计算任务并自动编写脚本求解,将逻辑确定性交给代码执行。这种转变标志着...
近期社区流行通过本地代理将DeepSeek模型接入Claude客户端,旨在以低成本享受Claude的交互体验。实测发现,该方案虽然利用了DeepSeek极高的性价比,但在功能上存在明显短板。首先是完全丧失视觉能力,无法读取图片;其次是模型输...
Orthrus-Qwen3 是一种基于 Qwen3 的创新双架构框架,通过将自回归 LLM 的精确生成能力与扩散模型的高速并行解码相结合,实现了高达 7.8 倍的推理速度提升。该方法采用原生共享 KV Cache 机制,保证了零冗余内存开销...
随着生成式 AI 技术的普及,开发者和科技从业者在 AI 工具上的投入成为衡量行业商业化进程的重要指标。一项来自 Linux.do 社区的最新调研正在统计用户在各类大模型服务上的月度实际支出。调研范围涵盖了官方订阅(如 ChatGPT Pl...
AI 推理平台硅基流动近日加强合规管控,未完成实名认证的用户与组织 API 请求限制已调整为 10 RPM,且欠费或未认证用户将被停止服务。平台规定,自 2026 年 5 月 15 日起,未实名账户将彻底无法使用平台功能。此外,平台将历史赠...
针对AI编程中切换账号导致对话中断的痛点,本文提供了cc-switch工具的具体配置方案。通过修改 `model_provider` 别名及相关参数,开发者可在不丢失上下文的情况下,灵活切换不同的模型提供商(如从云端API切换至本地部署)。...