无需登录 数据私有 本地保存

Web Speech API 综合演示 - 识别与合成双向

27
0
0
0

使用教程

第一步:了解页面布局

打开本工具后,您会看到页面分为上下两大区域。上方是语音识别区,下方是语音合成区。语音识别区包含麦克风控制按钮、语言选择下拉菜单、识别模式切换开关以及实时识别结果的显示区域。语音合成区包含文本输入框、声音选择、语速音调音量滑块以及朗读控制按钮。两个区域之间有一个"发送到合成"的快捷按钮。页面顶部有导航栏,您可以快速跳转到页面的不同部分。

第二步:开始语音识别

首先在语音识别区选择您的目标识别语言。如果您说中文,就选择"中文(普通话)";如果说英文,就选择"English (United States)"。然后根据您的需要选择识别模式:持续模式适合连续语音输入,单次模式适合逐句识别。准备好后,点击麦克风按钮开始识别。首次使用时,浏览器会弹出麦克风权限请求,请点击"允许"以授权本工具使用您的麦克风。授权后,对准麦克风说话,您会看到识别结果实时显示在下方的文本框中。

第三步:使用语音合成

在语音合成区的文本框中输入您想要朗读的文字。您可以直接输入自定义文本,也可以点击下方的5个预设文本按钮中的任意一个来快速填充。然后在声音下拉菜单中选择一个声音,调整语速、音调和音量到您满意的数值。最后点击"朗读"按钮,工具就会使用选定的参数将文本合成为语音并播放出来。如果想要停止播放,可以随时点击"停止"按钮。

第四步:体验识别转合成

这个功能是本工具的一大亮点。先进行语音识别,当识别完成后,点击"发送到合成"按钮,识别出的文字就会自动出现在语音合成的文本框中。然后选择一个不同的声音,例如您用中文识别后选择一个英文声音进行朗读,或者选择一个不同风格的中文声音,来对比不同声音的效果。这种工作流非常适合语言学习者进行发音对比和听力练习。

第五步:调整合成参数

尝试调节语音合成的各项参数,感受不同设置下的声音变化。将语速从默认的1.0调整到0.5,再朗读同一段文字,您会发现语音变得更加缓慢清晰,适合需要听清每个发音细节的场景。将音调从1.0调整到1.5,声音会变得更加高亢。音量调节则在您需要控制输出音量时非常有用。建议反复调整并朗读同一段文字来比较不同参数组合的效果。

第六步:使用预设文本测试

工具内置的5个预设文本是精心设计的测试用例。中文问候语可以检验日常对话场景的合成质量;英文绕口令"Peter Piper picked a peck of pickled peppers"可以测试快速连续音节的处理能力;中文绕口令"四是四,十是十"可以检验声调的准确性和连读的自然度。建议逐一点击每个预设文本,从不同角度评估语音合成的表现,找到最适合您需求的声音和参数组合。