主流大模型长上下文能力大比拼:GPT、Claude、Gemini 与 DeepSeek 谁更强?
Linux.do 社区用户自发整理了一份直观的性能对比图表,涵盖了 GPT、Claude、Gemini 及 DeepSeek 四大主流旗舰模型的长上下文处理能力。测试数据详细展示了各模型在 128K、256K 及 1M 等不同上下文窗口下的...
标签索引 / 第 23 页
这个标签下有 609 篇文章。按时间回看相关判断与实践记录。
标签精选
Linux.do 社区用户自发整理了一份直观的性能对比图表,涵盖了 GPT、Claude、Gemini 及 DeepSeek 四大主流旗舰模型的长上下文处理能力。测试数据详细展示了各模型在 128K、256K 及 1M 等不同上下文窗口下的...
本文详细介绍了如何通过配置代码参数,让 DeepSeek V4 API 发挥最大性能。通过设置 `reasoning_effort=”max”`、开启思考模式并将 `max_tokens` 上限拉至 384K,开发者...
近日,DeepSeek在官方公众号配图中的一行小字引发了技术社区的关注。说明文字指出,受限于高端算力,目前Pro服务的吞吐量十分有限,预计今年下半年随着华为昇腾950超节点批量上市,DeepSeek Pro的价格将迎来大幅下调。这一信息不仅...
2026年4月18-24日 · 第28期 · 每周五发布 本周关键词:Agentic Workflows · 开源围剿 · 蒸馏摩擦 · 定价博弈 TL;DR — 30 秒看完本周 如果你只有 30 秒,记住这五件事: OpenAI 发布 ...
关于 DeepSeek V4 的讨论在科技社区引发热烈反响。尽管在部分硬性指标上可能略逊于国际顶尖旗舰模型,但 DeepSeek 凭借务实、高效及极具创新精神的工程化路线,成功开创了中国大模型的新范式。其通过技术突破与彻底的开放态度,在行业...
社区热议DeepSeek V4的预览版表现,尽管尚未发布完全体,该模型已强势跻身开源排行榜第一梯队。业界焦点在于其正式版是否会解锁多模态能力,以及在华为昇腾(Ascend)算力平台上的部署表现。随着此前关于大上下文窗口的许愿已应验,市场普遍...
DeepSeek的最新动态在科技圈引发强烈震动。据社区讨论显示,DeepSeek正在推行极具侵略性的定价策略,其Flash版本模型因成本极低被戏称为“简直不要钱”,而Pro版本也预示着后续将大幅降价。这一举动不仅展示了DeepSeek在算力...
随着DeepSeek V4的发布,业界关注到其坚持API计费模式,而未效仿智谱等厂商推出面向个人用户的“编程套餐”或订阅服务。这种策略引发了关于其商业规划的广泛讨论。相比于智谱通过Code Interpreter等产品直接服务C端,Deep...
本文来自Linux.do社区,基于LLM Benchmark Dashboard的公开数据,对DeepSeek V4 Pro系列模型进行了深度的推理逻辑测试。继此前的编程能力评测之后,此次测评重点关注模型在复杂逻辑推理、任务拆解及多步骤问题...
一位开发者在利用 DeepSeek 官方 API 进行 Agent 实验时遭遇意外情况:在未修改代码的情况下,原本调用的 deepseek-v3.2 模型被自动替换为 deepseek-v4 flash。经过一上午的运行,开发者才发现请求被...