跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 67 页

大模型

这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

算力告急?OpenRouter免费版Qwen模型现限流警告

近日,有开发者在OpenRouter平台发现,免费接入的Qwen 3.6-Plus模型开始频繁提示“速率限制”。报错信息明确指出问题来自“上游服务商Alibaba”,表明阿里云的算力资源正在面临高负载压力。平台建议用户绑定自有API密钥以规...

1 分钟阅读299 阅读
前沿哨所

强迫AI“讲道理”:一款CLI工具强制LLM为生成的答案提供解释

大型语言模型(LLM)常因缺乏逻辑推导过程而面临“黑箱”质疑,甚至产生幻觉。针对这一痛点,一款新的命令行界面(CLI)工具引起热议。该工具通过特定的提示策略,强制要求模型在输出答案的同时展示详细的推理链和依据。这种“强制解释”的机制不仅增强...

1 分钟阅读99 阅读
前沿哨所

只需5分钟训练一个微型 LLM?这个项目带你打破 AI 黑盒

GuppyLM 是一个仅拥有约 900 万参数的微型语言模型,其独特之处在于它通过扮演一条名叫 Guppy 的小鱼,以此揭开大模型训练的神秘面纱。该项目旨在向大众证明,构建一个 AI 模型并不需要博士学位或昂贵的 GPU 集群。借助谷歌 C...

1 分钟阅读257 阅读
前沿哨所

Claude App被指降智?开启思考模式仍难解经典“水果题”

近日,有科技社区用户反馈,在Claude官方App客户端中使用Opus模型测试经典的“水果题”(测试字符计数逻辑)时,即便开启了“思考开关”,模型仍反复给出错误答案(如29),而此前在网页版或其他环境下该模型能正确输出(如21)。用户质疑官...

1 分钟阅读307 阅读
前沿哨所

让Claude像原始人一样说话,竟能节省75%的Token成本

GitHub上一个名为“caveman”的项目提供了一种独特的Claude优化方案。通过让AI模型模仿原始人的语言风格——去除所有礼貌用语、冠词和修饰性词汇,仅保留核心技术术语和逻辑,该插件实现了高达75%的Token消耗降低。实测显示,这...

1 分钟阅读123 阅读