实操教程:通过英伟达API为Claude Code接入Kimi及GLM模型
本文是一篇针对开发者的实操指南,介绍了如何利用英伟达(Nvidia)的推理API端点,在Anthropic的CLI工具Claude Code中使用非官方模型。作者详细演示了在CC Switch中配置供应商、设置环境变量以及修改配置文件的全过...
标签索引 / 第 4 页
这个标签下有 59 篇文章。按时间回看相关判断与实践记录。
标签精选
本文是一篇针对开发者的实操指南,介绍了如何利用英伟达(Nvidia)的推理API端点,在Anthropic的CLI工具Claude Code中使用非官方模型。作者详细演示了在CC Switch中配置供应商、设置环境变量以及修改配置文件的全过...
Inception Labs 发布了号称全球最快的推理大语言模型 Mercury 2。不同于传统 Transformer 的自回归逐字解码,该模型创新性地利用扩散技术进行并行文本精炼,实现了生成模式的根本性改变。在 NVIDIA Black...
面对英伟达显卡价格高昂且货源紧缺的现状,社区发起了关于利用AMD显卡进行深度学习模型训练的讨论。文章汇总了Bilibili及知乎上的实操案例,探讨了在非CUDA环境下运行PyTorch的可行性与具体方案。这一趋势不仅反映了开发者对降低算力成...
英伟达提出了一项名为动态内存稀疏化(DMS)的新技术,旨在解决大模型在进行长链思考时的内存瓶颈问题。通过高效压缩键值(KV)缓存,该技术在仅用1000步训练的情况下实现了高达80%的压缩率。实验表明,DMS允许模型在相同计算预算下生成更多T...
OpenAI 正式发布 GPT-5.3-Codex-Spark 模型,首次在非英伟达硬件上运行,采用 Cerebras 的晶圆级引擎芯片。该模型专为代码生成优化,速度高达每秒 1000 tokens,比前代快 15 倍,显著提升开发者的迭代...
英伟达近日宣布,已在公司内部为30,000名工程师全面部署生成式AI编码工具Cursor。通过将AI深度集成至软件开发生命周期(SDLC),覆盖了代码生成、测试、调试及部署等关键工作流。数据显示,此举使工程师的代码产出量显著提升至原有水平的...
本文深入解析了Arm Cortex A725核心架构,特别是在英伟达GB10芯片中的实现。作为一款注重密度的核心,A725取消了MOP缓存并扩大了重排序缓冲区以优化面积和能效。通过与英特尔Skymont及AMD处理器的对比,测试显示A725...
NVIDIA正式开放Earth-2天气模型系列权重,涵盖中距离及临近预报模型。通过Earth2Studio框架,这些模型现已在Hugging Face和GitHub上线,致力于让全球开发者更易获取AI天气预报技术。该计划覆盖从观测数据处理到...
斯坦福大学、英伟达及加州大学圣地亚哥分校等联合团队发布了“发现型测试时训练”(TTT-Discover)技术。该技术突破了传统方法,通过在测试阶段进行强化学习,让AI能够针对特定科学难题实现“临场自我进化”。实验显示,该方法在数学、GPU算...
英伟达因大模型训练数据来源面临版权诉讼。原告最新诉状指控,英伟达为训练NeMo等模型,主动联系影子图书馆“安娜的档案”寻求付费高速访问。内部文件显示,英伟达员工询问服务详情后,管理层一周内即批准申请,获取了500TB盗版电子书访问权。英伟达...