同为国产算力训练,为何DeepSeek适配华为昇腾频遭质疑?
随着DeepSeek新模型的发布,社区中出现了一些针对其适配国产算力(特别是华为昇腾芯片)的嘲讽声音。然而,网友指出,智谱AI的GLM系列同样基于10万张华为昇腾910B芯片进行训练,并广泛支持华为昇腾、海光、寒武纪等多种国产算力卡进行推理,但当时并未引发类似的舆论风波。这一现象引发了关于“双标”的讨论:为何在国产替代的大背景下,De...
阅读全文实时动态 / 第 439 页
追踪 AI、开源与工程领域的重要动态。
随着DeepSeek新模型的发布,社区中出现了一些针对其适配国产算力(特别是华为昇腾芯片)的嘲讽声音。然而,网友指出,智谱AI的GLM系列同样基于10万张华为昇腾910B芯片进行训练,并广泛支持华为昇腾、海光、寒武纪等多种国产算力卡进行推理,但当时并未引发类似的舆论风波。这一现象引发了关于“双标”的讨论:为何在国产替代的大背景下,De...
阅读全文近日,第三方AI工具QClaw发布版本更新,引发社区关注。此次更新的核心亮点在于直接内置了Kimi、智谱GLM、MiniMax等多款国内主流大模型接口。据用户反馈,该工具采用积分制收费,但获取门槛极低,基本可实现“免费”使用。这一功能允许开发者和创作者在单一界面内无缝切换不同模型,以满足代码编写、文档撰写及数据分析等多样化场景需求,有...
阅读全文有用户在技术社区发帖反馈,在相同的IP环境和账号体系下,使用不同浏览器访问ChatGPT会出现显著的模型差异。实测发现,Chrome浏览器往往被限制使用GPT-4o且以中文回复,而Edge、Brave及指纹浏览器却能调用更高级的o1或5.5 think模型。这一现象引发业界猜测,OpenAI可能正根据浏览器指纹或环境参数实施差异化的流...
阅读全文一位开发者在社区分享了使用DeepSeek(文中提及v4pro)的深度体验。测试中,该模型在极短时间内阅读了20篇论文,并自动生成了包含思维导图和HTML页面的完整报告。此外,它还成功解答了关于Flatpak打包中DNS解析失败的具体技术难题。虽然因模型调用频繁导致账户余额耗尽,但此次实战充分展示了DeepSeek在科研分析与工程代码...
阅读全文近日,有开发者在社区实测DeepSeek时遭遇“账单惊魂”:仅通过一个简单的“Hi”问候和分析指令,模型竟进行了长达11分41秒的推理过程,最终产生4.13元人民币的费用。尽管DeepSeek以极低的API单价闻名,但此事暴露了推理模型(如DeepSeek-R1)的“烧钱”本质。即使用户输入极简,模型在后台展开的复杂思维链(CoT)也...
阅读全文近日,有科技爱好者反馈,OpenAI的GPT模型在执行具体的图像修改任务时表现不佳。尽管用户下达了清晰明确的指令,甚至使用了Pro版本,AI仍多次无法准确识别并修改图片中的指定内容。这一现象不仅暴露了用户对AI工具的高期待与实际表现之间的落差,也揭示了当前多模态大模型在处理复杂的、细节化的视觉空间指令时仍存在显著的技术瓶颈。
阅读全文据社区反馈,Anthropic 旗下 Claude AI 近期对使用额度的重置机制进行了细微但重要的调整。此前,用户的 5 小时额度通常在整点(如 10:00、11:00)统一重置,导致在临近整点耗尽额度时需等待近一小时。而最新的测试显示,该系统已将重置周期从“整点”优化为“半小时”为单位。这意味着用户在达到上限后的最长等待时间缩短了...
阅读全文DeepSeek发布了全新的V4系列模型,其核心突破在于攻克了高效能的百万级Token上下文处理技术。这一进展使得AI模型能够一次性“吞下”并理解海量数据(如长篇小说、大型代码库或复杂的自动驾驶日志),同时显著降低了长文本推理的计算成本。DeepSeek-V4在保持高性能推理的同时,通过架构优化解决了“长文本遗忘”痛点,这将对RAG(...
阅读全文继2024年收集了2709份开发者样本后,2026年Ruby on Rails社区调查现已启动。本次调查将重点关注AI技术在Rails开发工作流中的实际整合情况与真实效能。调查旨在通过开发者的一线视角,厘清AI工具是真正改变了生产方式,还是仅停留在概念层面。所有数据结果将免费向全社区公开,以便为行业提供客观的决策参考。整个调查过程匿名...
阅读全文DeepSeek 正式公布了 v4 版本 API 文档,标志着其最新一代模型的正式落地。本次更新推出了 `deepseek-v4-flash` 和 `deepseek-v4-pro` 两款新模型,并在 API 设计上保持了与 OpenAI 和 Anthropic 的高度兼容。开发者仅需修改 `base_url` 即可使用现有的 SDK...
阅读全文据开发者社区反馈,代号为“GPT-5.5”的神秘模型已悄然在后台上线。用户发现,尽管VSCode扩展因版本滞后将其错误显示为“自定义”模型,但在Codex CLI中该模型名称显示正常,且实际调用功能运行良好。这一界面显示与实际调用功能的“脱节”,强烈暗示OpenAI正在积极测试下一代大模型,而前端工具尚未及时适配新版本的API定义。
阅读全文据社区消息,DeepSeek与华为昇腾的绑定正在显著加深。随着今年下半年昇腾950超节点算力集群上市,DeepSeek Pro模型价格有望进一步大幅下降。DeepSeek创始人曾表示,成本降低是技术探索和工程优化的副产品。尽管市场曾担忧国产芯片拖累模型进度,但双方坚持构建自主开源生态。这一合作被视为国产软硬件从“磨合期”走向“成熟期”...
阅读全文近期社区讨论指出,随着 DeepSeek、Kimi 等新一代模型参数量向万亿(1T)级别逼近,开源大模型的“满血”部署正变得难以为继。用户实测发现,即便拥有 8 张 L20 显卡,在量化后也难以承载这些巨量参数,导致部署成本极其高昂。这一趋势引发了业界的广泛担忧:如果中小参数规模的满血模型(如 Qwen 系列)停止更新,现有中端算力硬...
阅读全文社区发现,在Kimi K2.6和DeepSeek-v4的技术报告中,针对同一标杆模型GPT-5.4的Terminal Bench 2.0跑分存在显著差异,数值分别为65.4和75.1,而同期对比的Gemini和Claude分数在两份报告中却保持一致。这一反常现象引发了外界对测试环境、提示词设置是否统一的强烈质疑。在“模型军备竞赛”日益...
阅读全文一位35岁的前端开发者在经历裁员与薪资腰斩后,深刻意识到单一职业路径的风险。他利用AI工具辅助编码,仅用一个月便全栈完成了一个AI生图网站的开发与上线。该项目技术栈涵盖Next.js、Node.js及Vue3,展示了AI如何极大地提升单人作战能力。作者认为,这次实践最大的收获在于从单纯的程序员视角向产品与运营视角转变,为身处中年危机的...
阅读全文DeepSeek宣布其API文档已更新至v4版本。此次更新的核心亮点在于API格式现在完全兼容OpenAI和Anthropic。这意味着开发者无需重构代码,仅需简单修改配置,即可直接利用现有的OpenAI或Anthropic SDK及兼容软件来调用DeepSeek的模型接口。这一策略极大地降低了开发者尝试DeepSeek的技术门槛与迁...
阅读全文一位拥有九年开发经验的程序员在社区发帖感叹,因一个月内连续四个 Claude Max 账号被封,导致工作陷入停摆。该程序员坦言,自去年深度依赖 Claude Code 辅助编程后,虽然效率倍增,但在失去 AI 支持的此刻,才惊觉自己已丧失独立编写代码的能力,陷入了严重的自我价值危机。这一“断奶”式危机,不仅揭示了平台合规风险,更赤裸地...
阅读全文近日,一款名为 kubebar 的开源工具发布,旨在解决开发者和运维人员监控 Kubernetes 集群的痛点。该工具集成于系统菜单栏,允许用户快速查看部署在服务器(如 Hetzner)上的 K3s 或 K8s 运行状态。作者因未找到类似 Codexbar 的现成方案,利用“vibe coding”(AI 辅助编程)快速完成了开发。这...
阅读全文针对当前AI角色扮演平台普遍存在的用户粘性低、长期记忆能力弱及缺乏多人互动等痛点,开发者提出了基于 Hermes Agent 机制的创新解决方案。该项目计划引入“内在反思层”和“跨会话记忆层”,使AI在生成回复前先进行推理,评估信任度并关联历史记忆。此举旨在打破现有竞品(如Character.AI等)的技术瓶颈,通过深度认知能力打造具...
阅读全文随着AI生图技术的飞速进步,图片逼真度已达到令人咋舌的程度,普通用户肉眼辨别真假的能力正面临巨大挑战。为应对这一日益严重的信任危机,开发者推出了一款名为“求真”的实用检测工具。该工具通过分析图片的元数据、来源痕迹以及利用AI辅助识别可疑的编辑信号,为用户提供多维度的风险等级评估。不同于提供绝对判决的工具,“求真”旨在提供辅助判断,帮助...
阅读全文