PROJECT INTRO
项目介绍
Whisper 是通用语音识别模型,可处理多语言转写、语音翻译、语言识别与语音活动检测。模型按 tiny、base、small、medium、large 和 turbo 等尺寸提供速度与精度选择。
项目提供命令行和 Python 调用方式,需要安装 ffmpeg。对伴侣系统而言,它通常承担把麦克风或语音消息转换成文字上下文的基础听觉层。
- 适合:需要本地或自托管语音转写、语言识别与翻译的伴侣系统。
- 平台:Python 运行环境,可使用 CPU 或 GPU。
- 使用方式:安装 openai-whisper 与 ffmpeg,选择模型后转写音频文件或接入实时管线。
- 许可:代码与模型权重均为 MIT。
◌
游客留言功能施工中
COMMENTS & FEEDBACK
评论与反馈
用过这个项目的人,可以回来告诉后来者:在哪个平台跑通、安装有没有踩坑、实际体验如何。第一版不要求注册账号,后续会接入轻量游客留言。
SOURCE & CREDIT
Atlas 负责介绍与导航,使用仍回到原作者。
我们不镜像项目文件,也不截走作者流量。安装、下载、版本更新与最新说明,以原作者提供的项目页面为准。