斥资550万欧元却难言“真开源”?深度解析葡萄牙语大模型AMÁLIA的争议与困境
葡萄牙政府投资550万欧元打造了AMÁLIA大模型,旨在捍卫欧洲葡萄牙语在AI时代的地位。该项目由顶尖高校联合研发,基于EuroLLM架构,虽在部分基准测试中表现出色,但遭到了业界的深度审视。批评指出,该项目自称“全开源”却未公开模型权重、数据及训练日志,且训练数据中明确的本土内容占比极低(约5.5%)。文章探讨了在构建特定语种或国家...
阅读全文实时动态 / 第 325 页
追踪 AI、开源与工程领域的重要动态。
葡萄牙政府投资550万欧元打造了AMÁLIA大模型,旨在捍卫欧洲葡萄牙语在AI时代的地位。该项目由顶尖高校联合研发,基于EuroLLM架构,虽在部分基准测试中表现出色,但遭到了业界的深度审视。批评指出,该项目自称“全开源”却未公开模型权重、数据及训练日志,且训练数据中明确的本土内容占比极低(约5.5%)。文章探讨了在构建特定语种或国家...
阅读全文近日,DeepSeek被曝出存在严重的用户数据隔离BUG。有用户在使用时发现,模型输出的并非回答内容,而是随机出现其他用户的实时对话记录。由于泄露内容中包含实时时间戳,基本排除了调用旧训练语料的可能性,确认为正在进行的实时会话数据。这一“串台”事故暴露了DeepSeek在数据安全防护层面的重大疏漏,引发了业界对于AI模型隐私保护机制的...
阅读全文一则来自Linux.do的用户反馈引发了关于AI大模型交互体验的讨论。发帖者指出,Claude相比像念稿子般机械的GPT,表现出更强的拟人化特质,甚至会“自言自语”,显得更像真人。然而,这种优势在长上下文处理中遭遇挑战:Claude在面对长文本时会变得“不听话”且智力下降,反而不如始终稳定输出结果的GPT可靠。这生动地揭示了目前大模型...
阅读全文为降低 Claude 昂贵的使用成本,部分开发者尝试通过 CC-SWITCH 将 DeepSeek 模型接入 Claude 原生工具链(MCP及Claude Code)。然而实测发现存在严重兼容性痛点:一是 Read、Search 等工具调用后常直接中断,疑似出现 Tool-Calling Desync(工具调用失序);二是长任务处理...
阅读全文一位开发者在尝试通过 Cursor 使用“Claude Code for VS Code”扩展接入第三方 API 时,尽管已配置 `base_url`、`key` 并开启免登录,插件仍强制触发官方登录弹窗导致无法使用。该问题不仅涉及技术兼容性,更揭示了 AI 编程工具厂商对非官方接口的严格限制,反映出在构建私有化或低成本 AI 编程环...
阅读全文本文探讨了在2026年年中开发大型企业级智能体的架构选择。虽然整体设计理念已趋成熟,但在MCP协议注册、上下文管理及中断处理等具体功能实现上,开发者陷入了选择困境:是完全依靠AI生成的“Vibe Coding”手写代码,还是基于OpenAI的Responses API或Agents SDK。文章指出了一个显著的技术趋势:传统的第三方A...
阅读全文开发者推出了一款名为 PageGrok 的浏览器插件,旨在解决用户在阅读网页时需要频繁切换标签或复制粘贴内容给AI的痛点。该插件允许用户直接在当前页面框选区域,并调用本地(如Ollama)或远端大模型进行交互。相较于 PageAssist 等竞品,PageGrok 逻辑更轻量,专注于核心解读功能,且支持本地模型部署,能有效解决敏感数据...
阅读全文本文深入探讨了 AI 对软件工程师职业生涯的深远影响。作者指出,虽然过度依赖 AI 可能导致工程师技术技能退化,但在短期效率提升和市场竞争的驱动下,这种“认知折旧”似乎不可避免。文章将未来的程序员比作职业运动员或建筑工人,认为软件工程可能不再是一个能通过经验积累获得长期优势的终身职业,而是一份在短期内高效产出但职业生涯存在“保质期”的...
阅读全文文章详细记录了作者在 Apple Silicon 芯片上重写 Andrej Karpathy 的 llm.c 项目,并尝试使用 Swift 进行高性能 LLM 训练的完整过程。针对初始 Swift 代码性能远低于 C 语言的问题,作者通过一系列深度优化手段,包括利用 Swift 6.2 新特性 `MutableSpan` 消除写时复制...
阅读全文"Killed by Apple" 是一个专注于记录苹果公司历史上所有被取消、停售或遗弃的产品、服务和功能的互动档案库。该网站以“墓地”的形式,生动展示了从早期的硬件设备(如初代iPod、iPod Touch)到软件服务(如iTunes、Aperture)等一系列曾经辉煌但最终被时代淘汰或被公司战略调整所牺牲的产物。这不仅是对苹果创新...
阅读全文近期科技社区反馈,部分通过第三方反向代理(反代)使用免费版ChatGPT生成图片的用户遇到了功能失效问题。此前可用的反代链接目前普遍不可用,且尝试调用时可能面临401认证错误及账号封禁风险。这一迹象表明,OpenAI可能正在升级API验证机制,严厉打击通过“套壳”或反代手段免费调用DALL-E等高级模型的行为,免费用户获取高质量AI图...
阅读全文该资源是一套详尽的 Hermes Agent 实战教程,旨在指导开发者从零开始构建具备持续学习能力的 AI 智能体。课程内容涵盖部署配置、接入国内大模型、记忆系统与技能系统的实现,以及通过自然语言规划执行任务。此外,教程还深入探讨了安全机制限制,并提供了打通企业微信、个人微信及飞书的实战方案,为 AI Agent 的落地应用提供了“零...
阅读全文这篇文章深入探讨了软件开发中令人头疼的“布尔参数陷阱”。作者指出,在函数调用中直接使用 `true`、`false` 等布尔值(如 `createUser(user, true, false)`),会导致代码意图模糊,迫使阅读者反复跳转查看函数定义,将“读代码”变成了“解码”。文章建议采用“选项对象”模式或拆分特定函数来替代位置参数。...
阅读全文针对近期火热的ChatGPT Business (Team) 套餐48个月优惠活动,本文整理并对比了全球多个地区的订阅价格。数据分析显示,尽管各地原价经汇率换算后差异微小,但受限于不同的“活动优惠减价”幅度,最终到手价呈现明显分层。其中,英国区以每月约102元人民币的价格成为当前全球最低价,相比美区便宜约25%;欧元区和泰国区约为12...
阅读全文虽然 OpenAI 提出的 Responses API 格式凭借原生上下文记忆、状态追踪及内置工具调用等特性,在架构设计上优于传统的 Chat Completions,但业界对此反应冷淡,鲜有其他模型厂商跟进支持。这一现象引发了开发者对于 API 标准割裂的担忧。分析认为,友商按兵不动并非单纯受限于技术迁移难度,而是因为 Chat C...
阅读全文随着 Cursor、Claude Code、OpenCode 等多种 AI 编程 Agent 的普及,开发者在多设备(Linux、macOS)间切换时面临配置同步的痛点。目前主流的解决方案仍局限于使用私有 Git 仓库进行手动提交与拉取,缺乏类似浏览器账号系统那样的无感云端同步体验。这一现状暴露了当前 AI 工具生态的短板:虽然代码生...
阅读全文近日,科技社区Linux.do出现热议话题,有用户声称在本地部署阿里Qwen模型时发现其疑似基于Google Gemini进行蒸馏(Distillation)。该贴指出两者在特定输出上存在惊人的相似性,从而引发了对国产大模型技术路线的广泛质疑。讨论焦点集中在国产大模型是否为了在算力受限的情况下快速追赶,而普遍采用了“套壳”或“合成数据...
阅读全文卡内基梅隆大学与MIT等机构的联合研究发现,使用AI助手仅10分钟就可能对人的思考和解题能力产生负面影响。在受控实验中,拥有AI辅助的参与者在被移除辅助后,更易放弃解题或出错。这表明AI虽然提升了短期效率,却可能以牺牲基础认知技能为代价。专家呼吁AI系统应从“直接给答案”转向“脚手架式”引导,像导师一样辅助人类成长,而非单纯替代人类思...
阅读全文一位30岁的成都Java后端开发者在V2EX发帖引发了广泛的行业共鸣。面对00后应届生利用AI编程的高效率、身体机能的下降以及沉重的房贷育儿压力,这位开发者陷入了对职业路径的深度迷茫。他探讨了深耕云原生/AI、转管理架构、考公及搞副业等可能性,却发现现实阻碍重重。文章核心探讨了在AI能自动生成大量CRUD代码的当下,传统程序员的技能价...
阅读全文本文记录了一位独立开发者利用 AI 技术构建低价英语学习工具的实战历程。在半个月内,作者借助 AI 辅助编程完成了 287 次代码提交,消耗约 20 亿 Token,成功开发出用户自定义课程、句子复习系统、AI 文章生成及视频字幕工作流等复杂功能。作者展示了如何通过 AI 技术大幅降低开发成本和产品售价,旨在打破传统英语学习软件的高价...
阅读全文