DeepSeek V4 Pro 跑分曝光:力压 Kimi 2.6 夺得 Livebench 开源模型冠军
据 Livebench 最新基准测试数据显示,DeepSeek V4 Pro 模型表现抢眼,成功超越 Kimi 2.6 荣登现阶段开源模型榜首。虽然在编程(Coding)单项指标上略显不足,但综合性能已处于行业领先地位。这一成绩标志着国产开...
标签索引 / 第 12 页
这个标签下有 609 篇文章。按时间回看相关判断与实践记录。
标签精选
据 Livebench 最新基准测试数据显示,DeepSeek V4 Pro 模型表现抢眼,成功超越 Kimi 2.6 荣登现阶段开源模型榜首。虽然在编程(Coding)单项指标上略显不足,但综合性能已处于行业领先地位。这一成绩标志着国产开...
商汤科技近日开启“Token Plan”内测活动,面向开发者提供免费的API调用额度。用户注册后,在公测期间可完全免费使用包括DeepSeek v4 Flash在内的多种大模型。该计划采用模型单独计量与5小时独立计数机制,账户下所有Key共...
本文记录了一次针对大模型前端生成能力的直观对比测试。作者利用自研的AQBot客户端,在相同的推理参数、配置及Prompt指令下,分别让DeepSeek-v4-flash和Mimo-v2.5模型生成JavaScript俄罗斯方块游戏。文章展示...
近日,有开发者在技术社区Linux.do发帖求助,指出在调用DeepSeek V4(推测指代其推理模型)API时,即使参考官方文档配置参数,模型仍然输出’思考’(Chain of Thought)内容,无法按预期关闭...
DeepClaude 是一款开源工具,旨在解决 Anthropic Claude Code 高昂的订阅成本问题。它允许开发者在保留 Claude Code 卓越的交互体验(即“身体”)的同时,将底层模型(即“大脑”)替换为 DeepSeek...
本文汇总了智谱、Kimi、字节、阿里、腾讯、百度、OpenAI、Claude等21家主流AI服务商的Coding与Token付费套餐。内容详细对比了从入门级到企业版的月费、并发限额及GLM-5、GPT-5等最新可用模型。文章揭示了当前AI编...
本文是一位资深开发者对当前主流AI大模型的深度实测与横向对比。作者详细评估了Gemini、DeepSeek、Qwen、Grok及GPT在代码生成、逻辑推理、UI体验及本地部署等方面的表现。核心发现包括:Gemini在视觉解题(识别手写题)和...
一位开发者在社区反馈,在使用DeepSeek进行多终端项目重构和Debug时,发现当上下文超过400K时,模型出现严重的注意力机制缺陷。主要表现为无法区分A-E五个不同终端,将所有输入错误指向A终端;在Debug过程中陷入“加埋点-收集日志...
一位技术博主分享了利用 DeepSeek 模型对 Anki 记忆卡片进行批量自动化整理的实践经验。博主在虚拟机环境中通过 openclaw 工具结合 AnkiConnect 插件,调用 DeepSeek-v4-flash 模型,依据“最小信...
开源项目「Aether 扶摇」正式发布,定位为安卓端高颜值本地 AI Agent 应用。发布仅一周,该项目凭借活跃的社区支持,已适配 OpenAI、DeepSeek、Anthropic 等主流大模型。其核心亮点在于全量支持 MCP 协议与 ...