SEE-SOL-LAB AI COMPANION ATLAS
源码公开原创五感与器官Self-host / Edge

SPEECH · EMOTION · AUDIO EVENTS

SenseVoice

SPEECH UNDERSTANDING MODEL · @QWENAUDIO

让伴侣听见文字之外的语言、情绪和环境声音。

SenseVoice 把转写、语言、情绪与音频事件放进同一个听觉模型,让伴侣获得比纯文字更丰富的声音上下文。

PROJECT INTRO

项目介绍

SenseVoiceSmall 面向中文、粤语、英语、日语和韩语,联合提供语音识别、语种识别、情绪识别和音频事件检测。

它适合把通话或语音消息转成同时含文字、情绪和环境标签的上下文,再交给伴侣判断回应方式。

  • 适合:希望让 AI 同时理解语音内容、情绪和声音事件的人。
  • 平台:Python 自托管,可接入 FunASR 等推理环境。
  • 使用方式:下载模型权重,按 README 运行推理或接入现有语音服务。
  • 许可:源码与模型按仓库 LICENSE 和模型条款使用。

COMMENTS & FEEDBACK

评论与反馈

游客留言功能施工中

用过这个项目的人,可以回来告诉后来者:在哪个平台跑通、安装有没有踩坑、实际体验如何。第一版不要求注册账号,后续会接入轻量游客留言。

SOURCE & CREDIT

Atlas 负责介绍与导航,使用仍回到原作者。

我们不镜像项目文件,也不截走作者流量。安装、下载、版本更新与最新说明,以原作者提供的项目页面为准。