SEE-SOL-LAB AI COMPANION ATLAS
开源原创五感与器官Cross-platform

HEARING · TRANSCRIPTION · LANGUAGE

Whisper

SPEECH RECOGNITION MODEL · @OPENAI

把人类说出的声音转成文字,让伴侣真正听见多种语言。

Whisper 用统一的多任务模型处理多语言语音识别、翻译和语言判断,是许多本地伴侣听觉系统的基础耳朵。

PROJECT INTRO

项目介绍

Whisper 是通用语音识别模型,可处理多语言转写、语音翻译、语言识别与语音活动检测。模型按 tiny、base、small、medium、large 和 turbo 等尺寸提供速度与精度选择。

项目提供命令行和 Python 调用方式,需要安装 ffmpeg。对伴侣系统而言,它通常承担把麦克风或语音消息转换成文字上下文的基础听觉层。

  • 适合:需要本地或自托管语音转写、语言识别与翻译的伴侣系统。
  • 平台:Python 运行环境,可使用 CPU 或 GPU。
  • 使用方式:安装 openai-whisper 与 ffmpeg,选择模型后转写音频文件或接入实时管线。
  • 许可:代码与模型权重均为 MIT。

COMMENTS & FEEDBACK

评论与反馈

游客留言功能施工中

用过这个项目的人,可以回来告诉后来者:在哪个平台跑通、安装有没有踩坑、实际体验如何。第一版不要求注册账号,后续会接入轻量游客留言。

SOURCE & CREDIT

Atlas 负责介绍与导航,使用仍回到原作者。

我们不镜像项目文件,也不截走作者流量。安装、下载、版本更新与最新说明,以原作者提供的项目页面为准。