跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 186 页

大模型

这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

无需绑卡!利用NVIDIA免费LLM API打造极速网页翻译

用户分享了利用 NVIDIA 提供的免费 LLM API(ministral-14b 模型)配合修改后的翻译插件进行网页翻译的体验。该方案效果极佳且响应速度快,最关键的是无需绑定信用卡,降低了使用门槛。虽然 API 存在每分钟 40 次的请...

1 分钟阅读475 阅读
前沿哨所

科研生实测AI工具流:低成本组合拳提升实验效率

一位研究生分享了自己的低成本AI科研工具组合,包括每月5美元的OpenAI Team用于写代码,Copilot学生版配合Claude进行代码审查,以及使用Gemini阅读文献。此外,他还尝试将论文和汇报内容输入NotebookLM,但发现其...

1 分钟阅读202 阅读
前沿哨所

深度解析:AI代码搜索的原理与RAG优化策略

本文深入探讨了基于嵌入模型的代码库索引技术。文章回顾了从传统grep到神经代码搜索的演变,详细解析了CodeBERT、StarCoder及OpenAI等模型的数学原理与架构。同时,介绍了基于AST的结构化代码切片技术,以及HNSW和量化等向...

1 分钟阅读195 阅读
前沿哨所

逃离大厂内耗:技术人为何向往独立开发?

文章对比了企业开发中的“非技术消耗”(如会议、需求对齐、大模型使用限制、硬件老旧)与业余独立开发的纯粹快感。作者指出,在业余项目中,开发者能享受架构设计与性能优化的乐趣,拥有技术栈自主权。然而,独立开发也带来了推广与盈利的新烦恼,揭示了技术...

1 分钟阅读216 阅读
前沿哨所

Modal推出GPU内存快照技术,实现AI模型亚秒级启动

Modal 发布了 GPU 内存快照技术,致力于在 2025 年实现亚秒级启动。这一突破对 AI 和 LLM 部署至关重要,能显著降低模型加载延迟,提升云端推理效率。社区讨论了其底层实现可能涉及 gVisor 或 Firecracker,并...

1 分钟阅读241 阅读
前沿哨所

Vercel 揭秘:如何将 v0 打造成高效 AI 编程代理

本文探讨了 Vercel 如何优化其 AI 编程代理 v0 的性能。主要策略包括:在调用大模型前,将长 URL 替换为短字符串以节省 Token 并提升速度;以及在只读文件系统中提供人工精选的代码示例。这些示例帮助模型识别特定模式(如图像生...

1 分钟阅读275 阅读
前沿哨所

开发者实战:OpenAI Codex深度使用指南与高效配置技巧

本文是一位资深开发者分享的OpenAI Codex深度使用经验。作者首先解释了大模型的基础知识,如数据来源、Token机制及训练阶段,帮助读者理解模型行为。接着详细介绍了Codex CLI的工程结构、Agents.md配置规则以及MCP协议...

1 分钟阅读341 阅读
前沿哨所

硬核技巧:无需RAG,直接用百万字提示语打造超级AI助手

本文介绍了一种无需RAG(检索增强生成)的AI Agent构建新思路。作者通过直接将约50万至100万字的专业指南手册作为提示语输入给大模型(如Qwen),成功打造了一个功能强大的超级AI助手。实测显示,该助手在AI生图、编程、数据分析、深...

1 分钟阅读180 阅读
前沿哨所

告别“AI味”:用Prompt让模型回归正常语言

本文分享了一个旨在解决大模型“不说人话”问题的Prompt。该Prompt将模型设定为博学健谈的学者,要求其直接输出核心内容,严禁客套寒暄和廉价情绪价值。它强调拒绝互联网黑话,基于事实展开深度论述,避免滥用比喻和机械列表。测试表明,该Pro...

1 分钟阅读180 阅读