OpenMOSS推出MOSS-Transcribe-Diarize模型,这是一款创新的AI语音处理工具,能够自动识别最长90分钟视频或音频中的不同说话者,并添加精确时间戳标记。该模型通过深度学习算法实现多人声分离与转录,极大提升字幕制作效率,适用于会议记录、视频字幕等场景。用户可通过在线演示平台上传文件进行实时转换,展示了AI在语音识别领域的最新突破,为多场景自动化处理提供强大支持。
OpenMOSS发布多人声转文本模型,支持90分钟视频处理
未经允许不得转载:80aj » OpenMOSS发布多人声转文本模型,支持90分钟视频处理