Speech Lab实验语音学交互实验室
一组浏览器端教学与研究实验:声波、元音、声母、声调、语调、发声、呼吸、共鸣与音乐声学。另有 Intonation Lab,可导入音频、编辑 F0、标注音节并重合成试听。
GitHub 私有仓库 · 仅获授权用户可访问
查看仓库(需授权) ↗以实验语音学为基础,关注言语韵律与互动,将语言研究与 AI 语音教学、语料分析相结合。
研究领域包括实验语音学、互动语言学、言语韵律、汉语教学和艺术发声学。曾在中国科学院心理研究所从事博士后研究,并任塞尔维亚贝尔格莱德孔子学院中方院长。
已出版《汉语语篇的重音层级研究》《传媒有声语言实验研究》两部专著,主编《趣味汉语语音课本》,发表学术论文 30 余篇。
河南大学汉语言文学学士;北京广播学院(现中国传媒大学)播音主持艺术学院应用语言学系,语言学及应用语言学硕士;北京大学中文系语言学及应用语言学博士,实验语音学方向。
先后在商丘师范学院、中国传媒大学任教,曾任贝尔格莱德孔子学院中方院长;2018 年起任中国传媒大学人文学院教授。
主持国家社科基金一般项目“互动视域下语体驱动的汉语韵律表达研究”(24BYY039),并持续建设 AI 语音教学与 SoundSpace 语料研究平台。
从基础概念的教学动画,到 AI 语音教学,再到面向长期研究的语料平台。
一组浏览器端教学与研究实验:声波、元音、声母、声调、语调、发声、呼吸、共鸣与音乐声学。另有 Intonation Lab,可导入音频、编辑 F0、标注音节并重合成试听。
GitHub 私有仓库 · 仅获授权用户可访问
查看仓库(需授权) ↗面向学生、教师与管理员的语音教学平台:任务、示范音、录音 / 上传、音素与声调评分、流利度反馈、批量评测,以及 TextGrid 编辑与 ToPics 绘图。
Google Cloud 云服务 · 需使用管理员分发的账号登录,咨询账号申请。
打开教学平台 ↗语料研究的长期基础设施:规则、拼音与声调检索,语料浏览,TextGrid 在线编辑与发布,多模态数据导出、声学特征提取与统计,以及数据入库、权限管理和处理记录追踪。
私有 NAS 平台 · 通过可访问 NAS 局域网的 Tailscale 通道,并取得管理员分发的账号后可访问;同一局域网可直接打开。
打开语料平台 ↗从语音转写、JSON 转 TextGrid,到音视频处理和韵律画图,工具链覆盖研究资料进入平台前后的关键步骤。
WhisperX 词级转写、中文强制对齐与时间轴处理,适合把音视频素材加工成可编辑的语音数据。
将 WhisperX JSON 转换为 TextGrid,并支持规范化(Normalize)、时间调整(Timing)、修复(Repair),以及拼音层和说话人层处理。
上传音频及 TextGrid,调整参数后生成波形、语图、音高、强度、共振峰和标注层的多面板韵律图。
面向研究素材的格式转换、切分、合并、抽取和批处理,为转写、标注与语料入库准备统一媒体文件。
各服务的访问条件见卡片说明,可联系咨询。更多脚本与研究工具见 myddgithub/mypy ↗(私有仓库,需 GitHub 授权);已公开源码见 GitHub 项目列表 ↗。
教育与任职经历、教学课程、代表性成果和科研项目。
实验语音学;互动语言学;言语韵律;汉语教学;艺术发声学。
汉语语音学(硕士生);AI 语音教学与研究(实验语音学)(硕士生);汉语韵律研究(硕士生);语言学研究方法(硕士生);AI 赋能的语言实证研究:理论与实践 (博士生);传媒语言研究(本科生、硕士生);普通话口语训练(本科生);有声语言发声与表达艺术(本科公选课);口语正音(留学生);高级听说(留学生)。
Speech Lab 涵盖发音机制、声学分析、韵律和音乐听觉。项目存放于 GitHub 私有仓库,尚未公开;以下为模块介绍,使用方式可联系咨询。
欢迎就语音教学、声学分析、语料研究及工具使用交流。咨询平台访问时,请注明平台名称与用途。