纽约大学商学院教授发现学生利用LLM完成作业的能力与实际理解能力存在巨大差距,创新使用ElevenLabs语音AI代理进行口试评估。该系统通过Claude、Gemini、ChatGPT组成’评议会’评分,成本仅15美元完成36名学生评估。AI评分比人类更严格,最短考试学生获最高分,系统还揭示了教学薄弱环节。尽管学生反映压力较大,但70%认可其能真实评估理解水平,为后LLM时代教育评估提供新思路。
以AI制AI:ElevenLabs语音代理实现大规模口试
未经允许不得转载:80aj » 以AI制AI:ElevenLabs语音代理实现大规模口试
相关推荐
三大 AI IDE 深度解析:Trae、CodeBuddy、Qoder 国内外版本差异全对比
GitHub 热门 MiJi:打造书籍视频转化为 AI 智能体技能的自动化流水线
代码编辑器 Zed 推出 AI Agent 工具 Delta:主打协作与“全文本”架构
开源项目“能工智人”发布:支持人工介入的LLM请求中转与沙箱机制
Vibe Coding 时代开发者指南:当 AI 接管代码,人类还需要掌握什么技能?
AI编程工具陷资源消耗争议:Cursor被指引发严重内存泄漏与进程残留
谷歌 Gemini 3.8 Flash 模型低调上线,网页端与 Vertex AI 已可实测
AI 编码踩坑实录:高推理模型致过度设计,开发者耗时一月删减两万行冗余代码