方言语音识别
面向闽南语与南音唱念的 ASR 体系。基于 Whisper-largeV3 微调,在低资源方言场景下构建音节级识别能力。
寻音实验室(XUNYIN LAB)是一座专注于南音与计算声学交叉研究的独立实验室。 我们相信,古老声腔的传承不该只依赖口传心授—— 通过语音识别、发音评测、声纹建模与数据工程, 南音的每一个音节都可以被记录、被度量、被学习。
面向闽南语与南音唱念的 ASR 体系。基于 Whisper-largeV3 微调,在低资源方言场景下构建音节级识别能力。
以 WER / 音节错误率为核心的发音质量度量。动态规划对齐唱词与识别结果,输出逐音节、可解释的学习反馈。
与南音专家共建可追溯的标准音语料资产:批次采集、人工审核、模型复核,形成持续生长的高质量数据集。
从曲目、工乂谱到学习行为数据的全链路数字化。让非遗不只是被保存,而是进入现代学习与传播系统。
NANYIN AI LEARNING & EVALUATION PLATFORM
实验室的第一个完整作品 —— 覆盖学习、采集、审核全链路的 AI 评测平台。
学习者逐句录音,系统经由 VAD 切分校验 → 异步任务队列 → Faster-Whisper 识别 → WER 评分 → 逐音节错误定位 的完整管线,返回可解释的发音反馈。 专家侧持续采集标准音,管理员侧完成批次审核与模型复核, 让算法判断始终保留人工校准入口。
南音智能学习评测系统投入真实教学场景,持续积累学习行为与发音数据。
超越音节正确性,进入停连、行腔、韵律层面的风格化评测与生成研究。
将语料、模型与工具开放给更多非遗乐种,成为传统声腔数字化的公共基础设施。