DeepSeek发布mHC论文:约束超连接优化AI模型
DeepSeek团队近日发布了新论文mHC: Manifold-Constrained Hyper-Connections,该研究扩展了AI模型中的残差连接范式。通过扩大残差流宽度和多样化连接模式,mHC技术旨在优化模型性能,可能推动AI架...
DeepSeek团队近日发布了新论文mHC: Manifold-Constrained Hyper-Connections,该研究扩展了AI模型中的残差连接范式。通过扩大残差流宽度和多样化连接模式,mHC技术旨在优化模型性能,可能推动AI架...
2025年跨年之际,国内量化巨头九坤投资发起的至知研究院发布开源代码大模型IQuest-Coder-V1系列。该模型在SWE-bench权威评测中以81.4%的成绩刷新开源模型纪录,采用创新的Code-Flow训练范式,通过学习代码库历史演...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
本文分享了在电子书阅读器 Reeden 中利用 DeepSeek AI 模型进行辅助阅读的探索。作者详细描述了五种实用场景,包括回忆人物背景、获取剧情剧透、总结章节要点、查词解释和翻译单词。在实现技术上,作者比较了 RAG 向量库和普通文本...
DeepSeek App在手机端最新版本悄然上线了语音识别功能,支持语音转文字。用户在Linux.do论坛讨论中提到,DeepSeek发布的模型中似乎没有语音识别能力,因此推测该功能可能采用了公司未公开的自家语音识别ASR技术。这一更新可能...
一名用户在Linux环境下按照DeepSeek官网指南进行配置后,遭遇持续运行超时问题。用户尝试两天仍未解决,质疑是否必须使用梯子或存在配置错误。此问题引发社区讨论,反映了AI工具在实际部署中的技术挑战,尤其对开发者而言,凸显了优化部署指南...
Naver推出开源模型HyperCLOVA X SEED Think,在artificialanalysis站点得分仅44分,接近韩国模型EXAONE 4.0 32B;国产Deepseek R1得分52分;基于AA-Omniscience指...
HUBAGI平台近期推出大幅折扣API服务,官方稳定渠道DeepSeek V3.2、ViduQ2、Gemini 2.5 pro/3.0 pro/flash等模型均享4折优惠。逆向渠道更推出0.15一刀的Gemini和Claude模型,以及0...
拼好AI是一个专为个人用户设计的开源LLM API网关,旨在整合多个AI服务提供商的API,如OpenAI、Anthropic等。项目采用前后端分离架构,支持Docker快速部署,提供Web管理界面,兼容OpenAI和Anthropic格式...
一位开发者基于个人需求,从课后作业出发,开发了英语翻译插件。该插件利用DeepSeek AI API,提供单词模式(音标、释义、词源故事、例句、AI推荐图片)和句子模式(流畅整句翻译),并通过Python后端自动抓取Bing图片辅助视觉记忆...
用户在使用Google的Gemini 3 Pro AI模型尝试解决解密游戏Cogito Ergo Loot时,遭遇了异常行为:AI不仅暴露了思考过程,还陷入无限循环,持续输出“(End) Response”,导致token消耗激增。为避免资...