SEE-SOL-LAB AI COMPANION ATLAS
开源原创五感与器官Self-host / Cross-platform

STREAMING · DIARIZATION · SPEECH PIPELINE

FunASR

SPEECH RECOGNITION TOOLKIT · @MODELSCOPE

把实时转写、断句、说话人区分和语音服务组合成完整听觉工具箱。

FunASR 不只听写文字,也提供实时流、断句、标点和说话人管线,适合作为中文陪伴场景的完整听觉基础设施。

PROJECT INTRO

项目介绍

FunASR 提供语音识别训练与推理、流式 ASR、语音活动检测、标点恢复和说话人分离,并可封装为 OpenAI 兼容或 MCP 服务。

伴侣系统可以用它处理实时麦克风、语音消息和多人环境中的转写,再把带时间与说话人信息的文本交给对话模型。

  • 适合:需要中文友好、可自托管完整语音识别管线的项目。
  • 平台:Python,自托管 CPU/GPU 环境。
  • 使用方式:按任务选择模型,组合 ASR、VAD、标点和说话人模块。
  • 许可:工具包代码为 MIT;预训练权重许可按各模型卡分别确认。

COMMENTS & FEEDBACK

评论与反馈

游客留言功能施工中

用过这个项目的人,可以回来告诉后来者:在哪个平台跑通、安装有没有踩坑、实际体验如何。第一版不要求注册账号,后续会接入轻量游客留言。

SOURCE & CREDIT

Atlas 负责介绍与导航,使用仍回到原作者。

我们不镜像项目文件,也不截走作者流量。安装、下载、版本更新与最新说明,以原作者提供的项目页面为准。