跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E

实时动态 / 第 107 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
10-11
本页
20 条
累计
27,320 条

DeepSeek-V4-Pro发布:Agent能力大幅增强,支持灵活推理与OpenAI API兼容

DeepSeek正式发布了最新一代大模型DeepSeek-V4-Pro,标志着其在高性能推理模型领域的进一步突破。此次更新针对AI Agent(智能体)应用场景进行了深度优化,官方宣称在生产力水平上取得了显著进展。技术层面,DeepSeek-V4-Pro及V4-Flash引入了创新的“灵活推理”机制,允许开发者根据实际任务需求,动态调...

核心观点DeepSeek以“灵活推理”平衡成本与智能,凭借生态兼容性加速成为OpenAI最强平替,推动Agent应用普及。

阅读全文

针对LLM隐私泄露风险:开发者构建自托管PII屏蔽代理

近日,一个名为“自托管PII屏蔽代理”的开源项目在Hacker News引发热议。该项目开发者虽然使用了颇具争议的标题——“我告诉Claude Code不要泄露秘密,但它还是泄露了”——来吸引眼球,被部分社区成员批评为“标题党”,但其核心解决的技术痛点切中了当前AI开发流程中的关键软肋。该项目本质上是一个代理服务器,旨在部署在本地,拦...

核心观点单纯依赖大模型的安全承诺无法杜绝数据泄露,架构层面的强制脱敏才是AI工具落地生产环境的刚需。

阅读全文

实测DeepSeek V4 Flash + Claude双模协作:自研handoff工具实现自动化编程工作流

一位开发者在实测多个AI模型后,确立了以DeepSeek V4 Flash为执行核心、Claude为规划审核者的双模型工作流,并自研CLI工具“handoff”实现了全流程自动化。经过开发一个兼容RocketMQ协议的消息队列及handoff工具本身两个真实项目的验证,该方案在保证代码质量的同时显著降低了成本。数据显示,两个项目合计A...

核心观点“强模型规划+低成本模型执行”的高低搭配模式,配合自动化编排工具,正成为打破AI编程成本瓶颈、实现全天候无人开发的关键范式。

阅读全文

开发者实测:DeepSeek V4 Pro 工程代码能力遭质疑,简单脚本竟调用 Node.js 嵌套执行

据 Linux.do 社区开发者反馈,在使用 DeepSeek 系列模型进行 MCP 服务开发时,发现了一个令人意外的模型能力倒挂现象。该开发者在编写自动安装脚本时,首先使用了 DeepSeek V4 Flash 模型,生成的代码为标准的 Bash 脚本,结构工整且符合工程规范。然而,在后续使用 DeepSeek Harness 工具...

核心观点AI编程并非模型越大越好,DeepSeek V4 Pro 的“过度设计”证明:工程简洁度不仅是代码规范,更是对大模型推理逻辑的隐性挑战。

阅读全文

DeepSeek 开源智能体套件 Harness:基于 Cordis 架构,打造“万物皆插件”生态

DeepSeek AI 近日在 GitHub 平台上发布了全新的开源智能体开发框架 DeepSeek Harness (dsh)。该项目定位为一个高度模块化的智能体“套件”,旨在为开发者提供构建 AI 智能体(Agent)的基础设施。DeepSeek Harness 的核心亮点在于其独特的架构设计——系统理念为“万物皆插件”,并通过代...

核心观点DeepSeek Harness 将智能体开发引入时空计算维度,通过“一切皆插件”重塑 AI 应用的底层架构与生态标准。

阅读全文

DeepSeek 模型实测:一次性生成 Web 版《我的世界》,AI 编程稳定性引热议

近日,在开发者社区 Linux.do 上,一项针对 DeepSeek 模型的极限代码生成测试引发了广泛关注。测试者向 DeepSeek 模型(文中提及为 V4 Pro 正式版)发送了一个极具挑战性的提示词,要求“使用 Node.js 实现一个单机版 Web 版《我的世界》,并尽可能还原”,且需在本机浏览器环境下进行测试。这项任务不仅要...

核心观点DeepSeek 的实测结果验证了国产大模型在复杂代码构建上的潜力,但也警示行业:解决推理的不确定性,比单纯提升模型智商更为紧迫。

阅读全文

DeepSeek 推出 AI 编程工具 Harness,却关闭 GitHub 议题功能引发争议

DeepSeek 近期发布了名为“DeepSeek Harness”的开发工具,定位为 AI 编程与项目构建辅助平台,旨在对标 Cursor 等 AI 编程产品。然而,社区开发者发现,该项目的 GitHub 仓库虽然已开放公测访问,却意外关闭了“议题”功能。这一举动直接引发了社区对于“公测意义”的质疑。在开源及开发者工具领域,GitH...

核心观点封闭反馈渠道的公测试是无本之木,AI 厂商若想真正切入开发者生态,必须遵循开源协作的透明规则而非单纯“引流”。

阅读全文

实测11款大模型:Claude与DeepSeek代码生成效果惊人差异与成本真相

Netlify宣布与OpenRouter合作,将AI模型选择范围扩展至11款,包括Claude Opus 5、GPT 5.6、Gemini 3.6、DeepSeek V4及Kimi K3等,并实测了同一提示词在不同模型下的表现。测试基于构建一个咖啡店静态网站的任务,结果显示模型间的性能与成本差异巨大。Claude Opus 5虽然生成...

核心观点AI编程不再盲目追求最强模型,低成本、高效率的“精准控制”正在成为开发新范式。

阅读全文

DeepSeek 开源 Harness 框架:打造“一切皆插件”的 AI 智能体新生态

DeepSeek 团队近日正式发布了 DeepSeek Harness 开发者预览版,这是一款面向 AI 应用开发者的全新框架工具。该项目的核心设计理念是“一切皆插件”,旨在通过高度模块化的架构,解决大模型在实际应用中与外部工具交互的难题。技术实现上,DeepSeek Harness 基于 shigma 开发的 Cordis 插件系统...

核心观点DeepSeek 补齐生态短板,插件化架构通过解耦模型与工具,有望加速 AI Agent 的大规模低成本落地。

阅读全文

首个测试发现 DeepSeek Harness 存在上下文重复注入 Bug

近日,有开发者在技术社区 Linux.do 发帖指出,新兴 AI 编程工具 DeepSeek Harness 在初次测试中暴露了上下文管理的逻辑漏洞。该用户在完成 API Key 配置并创建首个会话进行简单问候时,分析工具后台注入的上下文数据,意外发现提示词内容存在严重冗余。

核心观点上下文管理的粗糙正成为 AI 编程工具落地的隐形障碍,Token 浪费比推理速度更刺痛开发者的成本神经。

阅读全文

DeepSeek 涨价后的性价比如何?一文看懂主流大模型价格与性能横向对比

近日,DeepSeek 的定价策略调整引发了开发者社区的高度关注。Linux.do 社区用户发布了一张详细图表,旨在直观对比 DeepSeek 调整价格后的性价比变化,并将其与 OpenAI、Claude 等主流大模型进行横向评测。该分析基于 DeepSWE 基准测试的 API 价格以及订阅套餐的折算成本,通过具体的数据量化了不同模型...

核心观点大模型竞争已从技术比拼转向性价比的精细化博弈,低成本高性能将重塑行业定价逻辑。

阅读全文

DeepSeek 开源轻量级开发工具 Harness,支持一键启动 Web 界面

国产 AI 领军企业 DeepSeek 近期在 GitHub 平台上正式开源了代号为 "DeepSeek Harness" 的开发工具项目。该项目由社区用户在 Linux.do 论坛率先披露,其主要亮点在于极简的部署流程与高效的交互设计。根据 GitHub 仓库的描述,开发者无需复杂的环境配置,仅需在终端执行一行命令 `npx @de...

核心观点AI 厂商竞争焦点已从单纯拼算力转向拼开发体验,DeepSeek 试图用极简的 CLI 工具链来抢占开发者心智并构建生态壁垒。

阅读全文

DeepSeek 开源 Agent 框架 dsh:一切皆插件,对标 Claude Code

DeepSeek 正式发布开源 Agent 框架 DeepSeek Harness(简称 dsh)的开发者预览版。该框架定位为运行在本地机器上的编程智能体,其核心设计理念是“一切皆插件”,基于 Cordis 内核构建,允许用户在不修改源码的情况下,通过插件自由替换模型接入、工具注册及审批策略。dsh 提供四种运行模式,其中 PTC(程...

核心观点dsh 以“一切皆插件”重塑 Agent 架构,证明了未来编程智能体的核心竞争力在于灵活的可扩展性与工程化治理能力。

阅读全文

DeepSeek-V4-Pro 配置疑云:Hugging Face 参数规格疑似套用 Flash 版本

DeepSeek 近日在 Hugging Face 上发布的 DeepSeek-V4-Pro 模型配置引发技术社区质疑。开发者发现,目前正式版的 config.json 文件与早期预览版存在严重参数偏差。具体数据显示,Preview 版本显示其 hidden_size 为 7168,包含 61 个隐藏层和 384 个路由专家;而最新的...

核心观点开源大模型的竞争已从算法能力延伸至工程落地,低级的配置文件失误会直接透支开发者对技术严谨性的信任。

阅读全文

DeepSeek 发布命令行工具 dsh,开发者工作流再添 AI 新势力

近日,在技术社区 Linux.do 及 NPM 平台上,AI 领域的新锐势力 DeepSeek 引发广泛关注。话题源于一款名为 `@deepseek-ai/dsh` 的 NPM 包的发布,被社区人士戏称为“戏诸侯”的神秘工具终于揭开了面纱。根据包名称及发布路径推测,这极有可能是 DeepSeek 推出的官方命令行接口工具。随着 Dee...

核心观点大模型之战正从云端对话延伸至终端指令,DeepSeek 用 dsh 锁定了开发者的高频交互入口,这是 AI 落地生产环境的关键一步。

阅读全文

Anthropic推出Claude Code推广计划:分享链接送一周试用,推荐付费获$10额度

AI实验室Anthropic近期针对其开发者工具Claude Code推出了新的推广激励机制。根据Linux.do社区披露的信息,该活动旨在通过现有用户的社交网络分发试用资格。具体功能方面,Claude Code用户可生成专属的“Guest Pass”(访客通行证)链接,将该链接分享给好友后,对方即可获得为期一周的Claude Cod...

核心观点Anthropic通过“以量换量”的推荐策略打破CLI工具的使用门槛,意在通过短期补贴快速收割开发者存量市场,构建AI编程生态的护城河。

阅读全文

用户实测Cursor版Grok:后台植入硬核安全锁,CTF场景全被禁

一位 Cursor Ultra 年费会员在技术论坛发帖,对 Cursor 集成的 Grok 模型表示失望。经测试发现,Cursor 针对 Grok 4.5 和 4.6 版本实施了额外的、极其严格的安全护栏。尽管此前针对 Grok 4.5 存在破限提示词,但在 Cursor 环境下,针对 4.6 版本的常规提示词注入已完全失效。通过技术...

核心观点平台级安全限制会削弱大模型的原生能力,SaaS 编程工具需在合规性与模型自由度间寻找平衡。

阅读全文

DeepSeek 发布官方 NPM 开发工具包:DeepSeek Harness

AI 领域热门企业 DeepSeek 正式推出了其官方 JavaScript/TypeScript 开发包 DeepSeek Harness(简称 DSH),并已上传至 NPM 仓库(包名 @deepseek-ai/dsh)。该工具的发布旨在降低开发者在 Node.js 及浏览器环境中接入 DeepSeek 大模型 API 的门槛。此...

核心观点DeepSeek 通过 DSH 补齐了前端工程化短板,以低门槛工具链抢占 JS 开发者心智,将加速大模型在应用层的落地渗透。

阅读全文

Anthropic 推出水印技术识别 AI 生成内容,引发 Claude 用户强烈不满

近期,AI 安全领域领先企业 Anthropic 宣布将在其大语言模型 Claude 中部署新型水印技术,旨在精准识别由 AI 生成的文本内容。此举引发了部分用户群体的强烈反弹与抗议。据报道,该水印技术通过在生成文本中嵌入统计学上不可见的标记模式,使得检测方能够高效区分人类写作与 AI 生成内容。许多依赖 Claude 完成学术作业、...

核心观点AI溯源技术的成熟标志着大模型从自由生成迈向合规监管,但也必将加剧模型厂商与灰色应用场景之间的技术对抗。

阅读全文

DeepSeek V4 Pro 正式发布:Agent 性能大幅增强,API 原生兼容 OpenAI 格式

DeepSeek 正式发布 V4 Pro 全系列正式版,并已同步至 APP、网页端及 API 接口。此次更新的核心亮点在于 Agent 能力的显著增强,特别是在生产环境中的任务执行表现有质的飞跃。针对公开基准测试集中的 Code Agent 任务,官方披露了特定框架下的测试数据,展示了模型在代码生成与执行层面的潜力。API 层面,De...

核心观点DeepSeek 以 API 兼容性和分级思考机制抢滩生产级 AI 市场,峰谷定价则揭示了算力时代的资源博弈本质。

阅读全文