跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_

实时动态 / 第 862 页

前沿哨所

追踪 AI、开源与工程领域的重要动态。

日期
08-29
本页
20 条
累计
26,319 条

开源插件:连接SillyTavern生态与IM工具,支持Telegram/WhatsApp端AI角色扮演

开发者近日发布了一款基于nanobot的开源插件,成功打通了SillyTavern角色生态与主流即时通讯软件的壁垒。该插件支持完整导入SillyTavern的预设、世界书和角色卡,并还原了其上下文逻辑。用户配置后,可直接在Telegram或WhatsApp中与AI角色进行沉浸式角色扮演对话。此外,插件集成了长短期记忆系统、标签过滤及技...

阅读全文

Anthropic 收紧合规:禁止将订阅认证用于第三方及 Agent SDK

Anthropic 近期更新了其法律合规文档,明确规定禁止将订阅制账户的认证信息用于任何第三方用途。这一禁令明确指出,即便是开发者构建 Agent SDK,也不得利用个人或团队订阅的凭证来调用 Claude 服务。此举旨在堵死非官方 API 调用的漏洞,防止订阅制套利,并强制有商业需求的用户转向官方 API 渠道,体现了大模型厂商对商...

阅读全文

破除偏见:实测发现豆包搜索已接入全球数据源,并不局限于头条系

针对大众普遍认为字节跳动旗下AI助手“豆包”仅搜索头条系内部数据的刻板印象,有用户通过实测发现,豆包实际上具备广泛的互联网搜索能力。通过检索日本动漫图片的案例证实,豆包不仅能够获取国内数据,还能直接抓取并引用日本本土网站的信息作为回答依据。这一发现表明,豆包的RAG(检索增强生成)系统已接入更广泛的开放网络索引,打破了仅限自家生态闭环...

阅读全文

谷歌Gemini 3.1 Pro现身AI Studio:跳过3.0正式版,性能全面跃升

北京时间2月19日午间,谷歌在Google AI Studio中悄然上线了Gemini 3.1 Pro模型。据首批试用用户反馈,新模型在注意力机制方面表现显著增强,综合能力较前代有全面提升。令人玩味的是,谷歌此次打破了常规软件的发布逻辑,在Gemini 3.0正式版尚未推出之时,直接发布了3.1版本,这一反常举动被解读为AI大模型军备...

阅读全文

谷歌Gemini 3.1 Pro实测:长文本生成能力大幅提升,性能重回巅峰

近期社区实测反馈,谷歌 Gemini 3.1 Pro 模型在长文本生成方面实现了显著飞跃。与此前输出受限的 3 Pro 版本相比,3.1 Pro 在相同提示词下可将报告字数从 5000 字提升至 15000 字左右,其性能表现已基本回归至备受好评的 2.5 Pro 水平。这一更新解决了用户长达四个月的痛点,标志着谷歌在长文本生成领域的...

阅读全文

新书发布:面向分析师的LLM Python实战指南,覆盖OpenAI/Claude全栈应用

这是一本专为数据分析师和社会科学家撰写的LLM实战指南,旨在帮助读者通过Python掌握大语言模型的核心技术。全书不仅涵盖了OpenAI、Anthropic、Google Gemini及AWS Bedrock等主流API的调用方法,还深入讲解了结构化输出、RAG(检索增强生成)、MCP及Agent开发等进阶应用。作者指出,相较于市面上...

阅读全文

提升AI任务管理效率:开发者给Anthropic「Productivity」插件新增专业甘特图

针对Anthropic推出的「Cowork」套件中的Productivity插件,社区开发者对其Dashboard进行了功能增强,新增了实用的甘特图视图。原版工具在任务数量增多时存在阅读困难,新版通过引入标准的甘特图视图,支持按模块展示、多维度筛选以及右键直接编辑时间等交互,显著优化了时间线管理的体验。这一修改不仅提升了AI代理在项目...

阅读全文

Gemini对话记录莫名消失,疑似版本更新引发UI故障

近日,部分 Google Gemini 用户反映遭遇了严重的界面故障,网页版侧边栏的聊天历史记录全部消失,导致用户无法正常查看过往对话。然而,用户发现通过直接点击历史对话的 URL 链接仍能访问具体内容,这表明后台数据可能并未丢失,问题主要集中在前端显示层面。社区猜测,该故障可能与 Gemini 近期推送的 3.1 版本更新或新增的音...

阅读全文

告别命令行!IDEA版Claude Code GUI插件v0.2发布,近5万次下载

IDEA Claude Code GUI 插件发布了 v0.2 版本更新,汇总了近期七个迭代版本的重要功能。该插件旨在解决 Claude Code 缺乏可视化界面的问题,让开发者能在 IDE 中直接使用。此次更新亮点包括:新增交互式 Diff 视图(支持代码Apply/Reject)、消息队列机制、输入历史记录与Tab补全,以及标签页...

阅读全文

AI赋能下的“个人开发者”困境:零基础自用小程序竟遭微信永封

一位数码爱好者因佳能官方打印体验不佳,在Gemini等AI工具辅助下,零基础成功开发了一款个人微信小程序。然而,该程序上线后不久即被微信以“恶意注册”为由永久封禁。此事不仅验证了AI辅助编程的强大能力,更折射出平台监管机制对个人开发者的严苛与误伤,引发了关于技术民主化与平台生态封闭性之间矛盾的深层思考。

阅读全文

电子工程师福音:立创EDA AI助手发布,可“读懂”原理图并自动查错

立创EDA社区正式发布了一款革命性的AI审查插件,旨在改变工程师传统的PCB查错流程。不同于自动化绘图,该插件专注于设计后的智能审查。它通过将原理图转换为结构化文本数据,让AI能够“读懂”器件引脚与网络连接,克服了传统视觉识别(OCR)无法理解复杂电路图的局限性。该工具支持Grok 4.2等具备联网能力的模型,不仅能精准定位错误元件,...

阅读全文

博弈圆桌:AI分身替你自动谈判,三轮博弈达成共识

这是一款基于多智能体协作的AI谈判应用,旨在通过自动化博弈解决利益冲突。用户可自定义场景(如年终奖分配)并设定底线,随后由DeepSeek与Second Me驱动的两个AI分身进行三轮自动谈判。系统参考了NeurIPS 2024论文策略,最终生成包含收敛度评分与风格分析的共识报告。该项目采用Next.js 16与React 19开发,...

阅读全文

ShannonMax:基于香农信息论优化Emacs快捷键配置的开源库

GitHub上一个名为ShannonMax的开源项目引发了开发社区的热议。该项目巧妙地将经典的香农信息论应用于现代文本编辑器的使用体验中,致力于解决Emacs用户复杂的快捷键配置难题。ShannonMax通过计算和分析按键绑定的信息熵,结合用户实际的命令调用频率,能够智能地计算出最优的按键映射方案。它建议将高频使用的命令分配给物理路径...

阅读全文

输入文字描述即可生成环境音乐,开源工具LatentScore无需GPU依赖

开发者Prabal发布了一款名为LatentScore的开源工具,用户只需输入文字描述(如“山间日出”或“霓虹城市”),即可生成匹配该情绪的程序化环境音乐。与Suno等主流生成式AI不同,LatentScore不依赖庞大的GPU模型或云端API,而是利用句子嵌入技术驱动本地自定义合成器,实现了零延迟、无追踪的即时播放。该项目目前处于A...

阅读全文

打通Elixir与Python:利用Oban实现基于数据库的跨语言任务调度

本文探讨了在Elixir应用中集成Python生态的最佳实践。针对Elixir在机器学习模型或特定文档处理库上的短板,作者提出利用Oban与共享PostgreSQL数据库的方案,替代复杂的HTTP调用或消息队列。通过统一的`oban_jobs`表,Elixir与Python可实现透明的任务双向流转与状态同步。文章以PDF生成为例,展示...

阅读全文

突破手机 AI 瓶颈:用 Claude 大脑指挥端侧模型,实现复杂任务全自动化

针对现有手机 GUI Agent(如 AutoGLM)依赖小模型导致的逻辑短板,开发者提出了一种创新的混合架构。该方案利用 Claude Code/Codex 作为高层“大脑”负责任务拆解、异常处理与决策,而让手机端的 GUI 小模型专注于底层屏幕识别与控件操作。这种“云端大模型 + 端侧小模型”的协同模式,成功实现了跨应用的长程规划...

阅读全文

告别“咱们哪儿聚”?这款开源 AI Agent 用球面几何+GPT-4o 智能算出折中点

开源项目 MeetSpot 致力于解决多人聚会选址难的问题。传统地图软件仅支持“我附近”的单点搜索,无法兼顾多人位置。MeetSpot 创新性地结合了球面几何算法与大模型能力:首先利用 Haversine 公式在地球曲面上计算多人的真实地理中点,确保距离公平;随后调用高德地图 API 搜索周边的咖啡馆、餐厅等 12 种场景 POI;最...

阅读全文

揭秘多语言AI的隐形漏洞:LLM安全护栏为何在非英语环境下形同虚设?

本文深入探讨了大型语言模型(LLM)在多语言环境下的安全风险与评估盲区。作者提出了“双语影子推理”概念,证明攻击者可利用非英语系统策略操控模型的推理链,使其生成看似专业实则带有偏见或误导性的总结,从而绕过安全审计。通过开源的“多语言AI安全评估实验室”,文章揭示了GPT-4o、Gemini等主流模型在阿拉伯语、波斯语等非英语场景中安全...

阅读全文