Kimi K3 不再是便宜替代品:开源 Coding 模型开始逼近前沿
本文整理自 BridgeMind 对 Kimi K3 的一次上手测试:它不再只是便宜替代品,而是开始在 UI 设计、全栈应用生成和真实 agentic coding 任务里挑战闭源前沿模型。原视频:https://www.youtube.c...
标签索引
这个标签下有 93 篇文章。按时间回看相关判断与实践记录。
标签精选
本文整理自 BridgeMind 对 Kimi K3 的一次上手测试:它不再只是便宜替代品,而是开始在 UI 设计、全栈应用生成和真实 agentic coding 任务里挑战闭源前沿模型。原视频:https://www.youtube.c...
Z.ai 的 Zixuan Li 讲 GLM-5.2。他这场的主张很直接:frontier intelligence 和 open weights 可以同时存在。软件工厂要长期成立,不能只依赖封闭模型。 原视频:https://www.yo...
随着大模型技术飞速迭代,AI应用开发者正面临严峻的“选型焦虑”。有开发者吐槽,此前基于Qwen系列开发的AI项目,因时间跨度较长且新模型(如Llama 3、DeepSeek等)层出不穷,如今面临“技术过时”的质疑。这一现象揭示了当前开源AI...
Cactus Compute团队推出了名为Needle的超微型语言模型,参数量仅为2600万(26M)。该模型通过知识蒸馏技术从Gemini 3.1中提取核心能力,专注于高效的“工具调用”场景。尽管体积极小,Needle在单次函数调用任务中...
Hacker News热议Zyphra发布的ZAYA1-8B模型,该模型采用混合专家(MoE)架构,虽然总参数量为80亿,但激活参数仅7.6亿,却在数学基准测试中表现与DeepSeek-R1相当。社区讨论认为,这标志着小型本地模型正迅速缩小...
据 Livebench 最新基准测试数据显示,DeepSeek V4 Pro 模型表现抢眼,成功超越 Kimi 2.6 荣登现阶段开源模型榜首。虽然在编程(Coding)单项指标上略显不足,但综合性能已处于行业领先地位。这一成绩标志着国产开...
本文是一位资深开发者对当前主流AI大模型的深度实测与横向对比。作者详细评估了Gemini、DeepSeek、Qwen、Grok及GPT在代码生成、逻辑推理、UI体验及本地部署等方面的表现。核心发现包括:Gemini在视觉解题(识别手写题)和...
随着 AI 大模型技术的飞速发展,许多开发者与重度用户正面临“成本”与“性能”的双重焦虑。一方面,以 GPT 为代表的头部模型近期大幅收紧免费额度,且订阅费用高昂,对于非高频用户显得性价比不足;另一方面,各类轻量级开源模型虽然门槛低,但在处...
近日,社区用户实测了由Jackrong蒸馏的Qwopus3.6-27B-v1-preview模型,效果令人印象深刻。该模型主打200k超长上下文窗口与多模态能力,实测中其图像识别速度极快,基本实现秒回。在代码编写任务中,模型响应迅速,不做过...