AI模型实测:DeepSeek与GPT系列回答能力对比
近日,有用户对不同AI模型的回答能力进行了实测对比,重点关注了Gemini 3 Pro、DeepSeek和GPT-5.2/GPT-5.1的表现。测试发现,GPT-5.2在回答问题时仅提供’数学期望下是大概率亏的’的简...
标签索引 / 第 230 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,有用户对不同AI模型的回答能力进行了实测对比,重点关注了Gemini 3 Pro、DeepSeek和GPT-5.2/GPT-5.1的表现。测试发现,GPT-5.2在回答问题时仅提供’数学期望下是大概率亏的’的简...
Octopus是一款专为个人用户打造的LLM API聚合服务,具有美观优雅的界面设计。该工具支持OpenAI Chat、OpenAI Responses和Anthropic三种协议之间的无缝转换,用户无需反复更新BASEURL和MODEL_...
DeepAudit是一个基于Multi-Agent协作架构的开源代码安全审计平台,已在GitHub开源v3.0.0版本。它模拟安全专家思维,通过Orchestrator、Recon、Analysis、Verification等智能体自主协作...
VocabMeld是一款基于AI技术的Chrome浏览器插件,通过智能替换网页词汇创造沉浸式双语学习环境,让用户在日常浏览中自然习得语言。该应用基于语言学家Stephen Krashen的’可理解性输入’理论,在保持...
Cherry Studio是一款专为大模型API设计的桌面客户端,以其简洁配置和卓越体验脱颖而出。用户只需填写API密钥即可接入主流大模型,无需复杂设置。其独特的分叉功能允许用户不满意时回溯到合适起点继续对话,提升交互灵活性。此外,客户端集...
这篇文章讨论了一项关于大语言模型(LLM)多样性的前沿研究。后训练过程常导致模型多样性下降,引发模式崩溃现象,而研究指出这源于数据级的典型性偏差,而非算法限制。作者提出语言化采样(Verbalized Sampling)方法,可有效缓解问题...
本文通过逆向工程实验,揭示了ChatGPT记忆系统的四层架构:会话元数据实时适应环境(如设备、位置),用户记忆长期存储用户事实(如姓名、职业偏好),最近对话摘要轻量级提供跨对话连续性,当前会话消息滑动窗口保持对话连贯性。研究发现,ChatG...
开发者分享了利用AI辅助编程(Vibe Coding)开发记账APP的完整经历。从寻找现有工具开始,因找不到支持AI识别和跨平台的记账APP,决定自己动手开发。在开发过程中,虽实现了拍照输入和桌面/移动端支持,但因缺乏React知识,AI生...
本文分享了一位科技爱好者在小米手机上部署智谱开源的autoGLM大模型的实战经历。作者详细描述了设置开发者权限、使用ADB控制、本地部署8-9b模型的步骤,并测试了图像识别功能。测试结果显示,模型在app识别上出现错误,未能准确执行指令。作...
开源工具’牛人快跑’基于AI大模型,专为Boss直聘求职者设计,实现自动开聊、已读不回提醒、职位筛选等功能。该工具采用Puppeteer、Electron、Vue等技术开发,兼容OpenAI SDK生成智能话术,支持...