开发者实战反馈:Gemini 3.1 在 iOS 代码生成上竟优于 GPT 5.5
近日,在开发者社区 Linux.do 的讨论中,多位开发者反映了一个出人意料的现象:在 iOS 代码编写任务上,Google 的 Gemini 3.1 Pro 表现似乎优于 OpenAI 的 GPT 5.5。据用户反馈,GPT 5.5 即使在高推理模式下,也多次在布局构建和动画逻辑上出现 Bug,无法实现预期效果,而这些棘手问题最终均...
阅读全文实时动态 / 第 365 页
追踪 AI、开源与工程领域的重要动态。
近日,在开发者社区 Linux.do 的讨论中,多位开发者反映了一个出人意料的现象:在 iOS 代码编写任务上,Google 的 Gemini 3.1 Pro 表现似乎优于 OpenAI 的 GPT 5.5。据用户反馈,GPT 5.5 即使在高推理模式下,也多次在布局构建和动画逻辑上出现 Bug,无法实现预期效果,而这些棘手问题最终均...
阅读全文科技社区Linux.do近期引发关于“最强国产大模型”的热议。多位开发者对比了智谱GLM、Kimi、MiniMax及DeepSeek等头部模型。用户反馈显示,智谱GLM凭借稳定性获得青睐,Kimi与MiniMax表现中规中矩。值得注意的是,近期在论坛声量极高的DeepSeek DS4 PRO被部分用户指出存在“名不副实”现象,在实际文...
阅读全文谷歌工程师Addy Osmani发布“Agent Skills”项目,旨在解决AI编码代理像初级工程师一样只顾写代码而忽视工程规范的问题。文章指出,AI默认会跳过规格文档、测试和代码审查等关键步骤。该项目通过将高级工程师的工作流转化为可执行的“技能”,引入“流程重于散文”和“反合理化表格”等机制,强制Agent遵循SDLC全流程。这不...
阅读全文Hacker News 上近日发起了关于“AI替工代价”的深度讨论。评论区的用户们普遍表示怀念真实的人类体验,甚至开始通过浏览痕迹来筛选和拒绝“AI垃圾内容”。讨论的高潮在于原作者透露,在使用 Claude 辅助润色时,AI 竟试图大幅扩充文章范围并强行更改标点风格,这种极具诱导性的辅助让作者感到难以抗拒。这一细节揭示了当前生成式 A...
阅读全文据技术社区消息,OpenAI 正在升级账户风控手段,通过“配额重置”这一技术细节来识别并封禁违规账户。这一策略主要针对市面上泛滥的灰产 API 和低价转售渠道,旨在遏制账户滥用行为。随着这一收紧措施的执行,依赖非正规渠道获取低价算力的开发者与服务商将面临断供风险,AI 行业的使用门槛与合规成本正被进一步抬高。
阅读全文本文源自Hacker News的一则热门讨论,聚焦一项关于Transformer模型的最新理论研究。该研究提出了“Transformer天生简洁(Inherently Succinct)”的观点,试图从理论角度解释该架构为何在处理复杂语言任务时表现出惊人的效率与表达能力。尽管评论区因标题的双关意引发了关于“变形金刚”角色的调侃,但核心...
阅读全文由 Kubernetes 联合创始人创办的 Stacklok 公司推出了名为 Frizbee 的新工具,旨在解决软件供应链中版本验证的难题。该工具的核心机制是接收一个版本标签(如 Docker 或 Git 标签),并返回其对应的加密校验和。通过建立人类可读标签与机器可读哈希值之间的确定性链接,Frizbee 能够帮助开发者自动验证制品...
阅读全文OpenAI 已开始向用户发送通知,要求其免费账号必须在 2026 年 5 月 11 日前完成年龄验证,否则账号将被停用。这一举措表明 OpenAI 正在收紧用户准入政策,旨在应对全球范围内日益严格的数据隐私及未成年人保护法规。尽管截止日期看似宽裕,但这标志着 AI 服务正加速告别“无门槛”时代,用户身份审核将成为未来行业的合规常态。
阅读全文本文针对 OpenCode Go 平台的 DeepSeek V4 模型(Pro 与 Flash)进行了详尽的购前成本分析。通过对比“打包额度”与“官方 API 计价”的实际开支,数据显示:DeepSeek V4 Pro 的打包价格基本等同于官方原价(API 折扣前),而 Flash 模型则略高于 API 直充成本。文章进一步结合高达 ...
阅读全文近日,有用户发帖指控OpenCode Go平台涉嫌DeepSeek服务计费虚假宣传。虽然平台宣传页显示已跟进DeepSeek官方的降价促销策略,但用户实际账单显示,其V4 Pro模型仍按旧的高价标准(输入12元/输出24元)扣除额度。这意味着平台虽然名义上宣传低价,但实际并未将折扣红利给到用户,存在“挂羊头卖狗肉”的嫌疑,引发了社区对...
阅读全文杭州中级人民法院近日对一起典型的“AI替代人工”劳动争议案作出判决,引发行业热议。案件中,一名负责AI质量保证测试的员工,因AI系统表现优异被公司视为冗余,随即遭到降职降薪,拒绝后被解雇。法院最终判决员工胜诉,明确指出企业不能仅因AI技术效率更高就直接单方面解除合同。法院强调,在智能化转型过程中,若企业因技术替代调整岗位,必须履行提供...
阅读全文针对在 CC Switch 工具中观察到的现象——Claude 模型的 Token 实际消耗量虽然远低于 Codex,但其最终使用成本却显著高于 GPT 系列模型,该讨论深入分析了背后的原因。文章探讨了不同大模型厂商的定价策略差异,指出单纯的 Token 用量并非衡量成本的唯一标准,模型的单价、输入输出比率以及上下文处理效率同样至关重...
阅读全文这是一个名为“CMBIT”的趣味Web应用,将MBTI性格测试框架应用于猫咪行为分析,通过12道场景题将猫咪分为16种“猫格”。该项目技术栈采用纯前端实现并部署于Vercel,其核心亮点在于集成了Seedream 5.0图像生成API。在用户完成测试后,AI会根据猫咪的性格类型,为其生成一张穿着对应主题服装的专属Cosplay形象图片...
阅读全文正值一年一度的 AP 考试周,一位开发者为了辅助孩子备考,开发了一款移动端刷题网站。该平台整合了 18 个学科类别的 1 万多道题目,资料来源权威。除了采用游戏化设计(包含等级和奖杯系统)来提升学习趣味性外,该工具的最大亮点在于集成了 AI 技术。它不仅能判断答案对错,还能对错题进行深度分析,帮助学生理解背后的逻辑。这一案例展示了 A...
阅读全文近日,一款名为 CMBIT 的猫咪性格测试应用在开发者社区引发关注。该项目将流行的 MBTI 16型人格理论迁移至宠物领域,用户仅需通过 12 道趣味问答,即可判定自家猫咪是“幕后主使”还是“快乐小疯子”。技术实现上,该项目亮点在于集成了 Seedream 5.0 的图像生成能力,允许用户上传猫咪照片,AI 会根据测出的性格类型,自动...
阅读全文随着OpenAI和微软等巨头推行激进的使用量计费模式,AI编程的成本日益高昂。本文深入探讨了利用本地硬件(如24GB显存显卡或M系列Mac)运行Qwen3.6-27B等开源模型的可行性与实操细节。文章详细介绍了通过Llama.cpp部署模型、优化KV缓存以扩大上下文窗口的技术路径,并对比了Claude Code、Pi和Cline三大主...
阅读全文台湾法院对台积电2纳米技术泄密案做出判决,前工程师陈力铭因违反《国家安全法》窃取“国家核心关键技术”被判10年徒刑。该案涉及将蚀刻设备等机密泄露给供应商东京电子台湾分公司,以助其提升竞标优势。除主犯外,另三名员工分别获刑,东京电子台湾分公司被重罚1.5亿新台币。此案不仅暴露了供应链内部的管理漏洞,更显示了台湾对关键芯片技术保护的最高规...
阅读全文开发者发布了名为OpenPet的开源桌面宠物运行时项目,旨在打破Codex宠物生态的平台限制。该项目完全兼容Codex pet标准,允许用户将宠物资源独立于原应用运行。更关键的是,OpenPet内置了MCP/API/CLI支持,使其能无缝接入Cursor、Windsurf等主流AI编辑器。这意味着开发者在编写代码时,可以通过现有的Ag...
阅读全文针对 OpenAI 最新推出的 gpt-image-2 图像模型目前仅限于 ChatGPT 客户端内使用的限制,社区开发者对开源项目 New API 进行了针对性魔改。该修改通过 Fork 项目代码,成功将 Codex 渠道背后的 gpt-image-2 生图能力剥离,并封装为标准的 OpenAI 兼容接口(/v1/images/ge...
阅读全文面对订阅多个 AI 服务导致用量查看繁琐的问题,开发者推出了名为 UsageBoard 的开源 macOS 应用。该工具集成了 Codex、智谱、DeepSeek、MiniMax 和 Tavily 等主流平台的官方 API,通过菜单栏常驻方式,让用户无需登录各个网站即可实时查看用量。它采用插件化架构,支持自动/手动刷新、Token 统...
阅读全文