概述:
这是一款基于OpenAI Whisper技术的实时、离线、跨平台语音识别插件,适用于游戏开发。该插件支持GPU加速(Windows/Linux使用Vulkan,Mac/iOS使用Metal),其他平台使用优化的CPU处理。它能够将语音实时转换为文本,支持95种以上语言的自动检测与翻译,并可与任何音频输入源集成。插件提供语音活动检测、噪声过滤和命令识别功能,且无需静态库或外部依赖,兼容Windows、Mac、Linux、Android、iOS等平台。
特点:
· 实时识别:玩家说话时即时将语音转换为文本
· 离线运行:无需互联网连接,所有处理均在本地完成
· 高性能:Windows和Linux使用Vulkan GPU加速,Mac和iOS使用Metal GPU加速,其他平台使用优化的CPU处理(如Android或Meta Quest原生运行时可能较慢)
· 跨平台兼容:支持Windows、Mac、Linux、Android、iOS等
· 多语言支持:支持95种以上语言的识别与翻译,具备自动语言检测功能
· 灵活集成:可与任何音频输入源配合使用
· 语音活动与命令检测:智能噪声过滤和命令检测,确保识别结果准确
· 可定制参数:根据需求微调识别过程
· 快速识别速度:实时到近实时,支持Vulkan和Metal GPU加速
· 多种模型选择:提供英语专用和多语言模型,多语言支持100种语言,模型大小从75Mb到2.9Gb不等
· 编辑器内自动下载语言模型
· 可选将识别语音翻译为英语
· 可定制属性,轻松选择模型大小和语言
· 无静态库或外部依赖
