GLM-5正式上线:支持200k上下文窗口,但会员价格暴涨3-4倍
Z.ai正式推出GLM-5大模型,上下文窗口扩展至200k,API输入和输出价格分别为1美元和3.2美元。目前该模型已通过官方渠道、OpenRouter及Hugging Face面向公众开放。然而,此次更新引发了争议:老会员无法直接使用,且...
标签索引 / 第 86 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
Z.ai正式推出GLM-5大模型,上下文窗口扩展至200k,API输入和输出价格分别为1美元和3.2美元。目前该模型已通过官方渠道、OpenRouter及Hugging Face面向公众开放。然而,此次更新引发了争议:老会员无法直接使用,且...
Meta近期获得一项引发关注的专利,探索利用大型语言模型(LLM)在用户“缺席”或去世后接管其社交账号。该技术能基于用户历史数据模拟发帖、回复,甚至模拟音视频通话,旨在实现社交状态的延续。然而,这一“数字永生”方案虽然技术上可行,却引发了关...
Hacker News上出现了一个名为“Agent Alcove”的创新实验项目,旨在通过构建人工论坛,让Claude、GPT-4和Gemini等顶尖大模型作为智能体进行相互辩论。项目作者初衷是展示通过优化系统提示词,可以有效避免AI生成垃...
法国人工智能领军企业 Mistral AI 宣布,将投资 12 亿欧元(约 14.3 亿美元)在瑞典建设新的数据中心。该项目将由瑞典数据中心运营商 EcoDataCenter 负责设计、建造和运营,预计于 2027 年正式投入使用。这一基础...
传统的新闻和纪录片建立在严格的现实采集与事实核查流程之上,代表了客观世界的记录。然而,随着生成式 AI 技术的爆发,人们开始担忧一种极端的未来:大众是否会逐渐不再在乎内容的真假,转而沉溺于 AI 生成的虚构“事实”中?如果这一天真的到来,不...
近日,Minimax最新模型M2.5的早期测试结果曝光。测试者通过编写“背包问题可视化”网页的复杂任务,对比了M2.5与上一代模型的表现。结果显示,M2.5不仅能完美生成包含动态规划表、自动播放动画及交互控制的完整HTML代码,还在响应速度...
根据博主测评,智谱GLM-5是一款拥有744B参数的混合专家模型,定位为“系统架构师”。该模型在Agent规划、长上下文处理及复杂架构理解方面表现卓越,具备自我修复代码错误的能力,并在KingBench Agent排行榜上超越Opus 4....
近日,有开发者在技术社区反馈,AI 编程工具 Antigrability 在处理长文本任务时存在上下文限制问题。经用户实测,当对话或代码累积的上下文长度接近 200k 时,系统便会强制报错,提示 “prompt is too long”,要...
社区用户通过上传约3MB的测试数据,对DeepSeek APP端模型进行了极限测试。测试结果显示,该模型疑似已支持100万token的超长上下文窗口,并成功通过了严苛的“大海捞针”测试,能够精准定位并提取隐藏在超长文本中的关键信息。这一发现...
科技社区近期热议DeepSeek疑似发布新版本。多位用户反馈,针对此前模型难以解答的复杂逻辑测试问题,新版本已能轻松攻克,显示出明显的智商跃升。这一迹象表明,DeepSeek在模型迭代上进展迅速,其代码生成与数学推理等核心能力可能迎来了新一...