谷歌重磅发布 Gemma 4:基于 Gemini 3 技术,专为 Agent 与边缘计算打造的终极开源模型
Google DeepMind 正式发布了其迄今为止最智能的开源模型系列——Gemma 4。该系列基于 Gemini 3 的研究技术构建,提供 E2B、E4B、26B 和 31B 四种尺寸,涵盖从移动端到高性能服务器的全场景需求。Gemma...
标签索引 / 第 4 页
这个标签下有 100 篇文章。按时间回看相关判断与实践记录。
标签精选
Google DeepMind 正式发布了其迄今为止最智能的开源模型系列——Gemma 4。该系列基于 Gemini 3 的研究技术构建,提供 E2B、E4B、26B 和 31B 四种尺寸,涵盖从移动端到高性能服务器的全场景需求。Gemma...
本文深度剖析了SQLite的现代化进阶能力。它不仅能通过内置的JSON扩展处理半结构化数据,还利用FTS5提供了高性能的全文搜索功能,无需额外搭建搜索引擎。此外,SQLite支持窗口函数与CTE,使其具备复杂的数据分析潜力;引入严格表和生成...
一位搭载 Intel Core Ultra 9 258K 处理器的用户意外发现,其台式机内置的 NPU(神经网络处理单元)并非闲置,而是被常用的游戏脚本成功调用。该脚本利用 NPU 对 OCR(光学字符识别)和 Yolo 目标检测模型进行了...
一款体积仅 0.1MB 的开源智能抠图工具近日在社区引发关注。该工具深度集成 Apple 的 VisionKit 框架,无需联网即可利用 macOS 14+ 的系统级算力完成高精度抠图。除支持单张图片处理外,它还具备批量文件夹处理及自定义背...
AI 初创公司 PrismML 宣布推出首批“商业可行”的 1-bit 权重大语言模型——1-Bit Bonsai 系列。该模型基于加州理工学院的突破性研究,通过极致的量化技术,在不牺牲精度的前提下实现了极高的智能密度。数据显示,其 8B ...
Google Research 近日宣布开源时间序列基础模型 TimesFM 2.5 版本。与上一代相比,新模型将参数量从 5 亿大幅精简至 2 亿,显著提升了推理效率,使其更适合在资源受限的设备上运行。同时,模型支持的上下文长度从 204...
开源社区发布了名为 OpenOmniBot(OOB)的安卓 AI Agent 项目,旨在探索移动端 AI 的“最强形态”。该项目创新性地结合了视觉语言模型(VLM)与命令行界面(CLI),使得 AI 不仅能识别屏幕内容,还能直接操作安卓终端...
Marginalia搜索引擎的开发者分享了构建NSFW内容过滤器的技术实践。由于Transformer等现代模型对GPU依赖严重且速度慢,作者尝试了FastText但未能解决上下文歧义问题。最终,作者采用了一种巧妙的混合策略:利用Qwen ...
欧洲核子研究中心(CERN)近日展示了处理海量实验数据的革命性方案。面对大型强子对撞机(LHC)产生的庞大且高速的数据流,CERN 研究团队开发出极小的定制化 AI 模型,并将其直接物理“刻录”到硅芯片中。这种“硅基 AI”技术能够实现纳秒...
谷歌Research推出名为“TurboQuant”的新型AI压缩技术,旨在通过极致的算法优化解决大模型部署的算力瓶颈。该技术能够在保持模型高精度的同时,显著降低模型体积与内存占用,从而大幅提升推理速度并降低能耗。TurboQuant不仅有...