独立开发者创新项目:将LLM虚拟人、视频识别与硬件触控全链路打通
一位独立开发者公开了一项结合了定制蓝牙硬件与双App的AI互动实验。该项目包含“Xcup”和“X姬”两款应用:前者基于本地视频分析技术识别画面动作并驱动硬件反馈,后者利用Unity与LLM打造具备长期记忆和主动对话能力的3D虚拟角色。整个系...
标签索引 / 第 45 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
一位独立开发者公开了一项结合了定制蓝牙硬件与双App的AI互动实验。该项目包含“Xcup”和“X姬”两款应用:前者基于本地视频分析技术识别画面动作并驱动硬件反馈,后者利用Unity与LLM打造具备长期记忆和主动对话能力的3D虚拟角色。整个系...
随着海外主流大模型获取难度增加,国内开发者正加速转向国产替代方案。社区实测显示,以DeepSeek、通义千问、Kimi为代表的国产大模型,在代码生成、逻辑推理及长文本处理上已具备较高水准。虽然与顶尖国外模型仍有细微差距,但在中文语义理解及本...
Hacker News社区热议了一款名为Antenna的RSS阅读器,其核心卖点是内置了MCP(模型上下文协议)服务器。开发者试图通过这种方式将RSS订阅源与AI Agent及LLM工作流深度集成,实现内容摘要、知识库归档或自动化触发等智能...
近日,有月付99元的Kimi 2.6用户在技术社区反馈,模型在回答问题时出现极度延迟,单次生成耗时接近2分钟,严重影响了使用体验。这一现象引发了业界对于大模型推理效率与基础设施负载能力的担忧。尽管Kimi在模型能力和上下文窗口上持续迭代,但...
近日,部分开发者反馈Claude模型在最新更新后出现严重的性能“倒退”现象。用户指出,新版Claude在执行代码编写任务时幻觉频发,且难以处理复杂的多文件工作流,导致其无法胜任高强度的开发辅助工作。这一“变笨”现象引发了用户对昂贵的Clau...
本文通过消耗32亿Token的实战经验,尖锐指出当下流行的“多Agent角色分工”模式存在根本性缺陷。作者认为,模拟人类团队协作会导致意图在层层传递中严重衰减,且LLM缺乏人类沟通中的纠偏机制。相比之下,Anthropic等头部厂商采用的“...
科技社区传出消息,月之暗面(Kimi)的最新开源模型 K2.6 已正式上线 Ollama 云平台。作为一款原生多模态 Agentic 模型,K2.6 专为处理复杂任务设计,在长视距编码、代码驱动设计、主动自主执行以及基于群组的任务编排等方面...
针对传统谈判调解中缺乏系统性流程的痛点,新项目 Mediator.ai 尝试利用大语言模型(LLM)与纳什议价解决方案来实现自动化公平调解。尽管约翰·纳什早在20世纪50年代就提出了谈判的数学框架,但实际应用中一直难以量化各方的“效用函数”...
针对近期业界热议的大模型“越更新越笨”或“主动降智”现象,一款全新的AI基准测试工具提供了客观的监测方案。该平台能够实时追踪并排名OpenAI GPT、Anthropic Claude及Google Gemini等主流大模型的性能指标。其核...
该资源汇集了一线工程团队关于“Trellis”的技术分享材料,重点探讨了软件开发流程从 Harness Engineering 向 Trellis 架构的演进与落地。内容主要分为两部分:一是大模型(LLM)的基础原理科普,二是如何构建和利用...