0

0

javascript如何实现语音识别_有哪些Web Speech API

夜晨

夜晨

发布时间:2026-01-15 18:09:09

|

963人浏览过

|

来源于php中文网

原创

web speech api 的 speechrecognition 是浏览器原生唯一语音识别接口,仅 chromium 内核稳定支持,需 https 或 localhost 环境、用户手势触发,且不支持 ios;firefox 几乎不可用,替代方案应依赖后端 asr 或离线 wasm 模型。

javascript如何实现语音识别_有哪些web speech api

Web Speech API 的 SpeechRecognition 是唯一可用的语音识别接口

浏览器原生支持的语音识别能力,目前只有 SpeechRecognition(部分浏览器中叫 webkitSpeechRecognition)这一个接口。它不是“多个 API 供你选”,而是 Web Speech API 规范中定义的**唯一语音识别构造器**。其他所谓“语音识别 API”要么是第三方 SDK 封装,要么是服务端 ASR 接口,不属于浏览器原生能力。

注意:该接口仍处于 W3C 工作草案阶段,且**仅在安全上下文(https://localhost)中可用**;HTTP 页面直接调用会静默失败。

如何创建并启动一次基础识别

必须通过 new webkitSpeechRecognition()(Chrome/Edge)或 new SpeechRecognition()(Firefox 实验性支持,实际几乎不可用)获取实例。主流稳定支持仅限 Chromium 内核。

const recognition = new (window.SpeechRecognition || window.webkitSpeechRecognition)();
recognition.continuous = false;  // 单次识别后自动停止
recognition.interimResults = false; // 不返回中间结果
recognition.lang = 'zh-CN'; // 显式指定语言,否则可能识别不准

recognition.onresult = (event) => {
  const transcript = event.results[0][0].transcript;
  console.log('识别结果:', transcript);
};

recognition.onerror = (event) => {
  console.error('识别错误:', event.error);
};

recognition.start(); // 必须由用户手势触发(如 click),不能自动调用
  • recognition.start() 必须由用户显式交互(如按钮点击)触发,否则 Chrome 会拒绝执行
  • lang 参数强烈建议设置,尤其中文场景不设可能 fallback 到 en-US,识别率骤降
  • interimResults: true 会触发多次 onresult,但中间结果不稳定,慎用于生产逻辑判断

常见失败原因和兼容性陷阱

90% 的“识别没反应”问题都源于环境或调用时机错误,而非代码本身。

紫东太初
紫东太初

中科院和武汉AI研究院推出的新一代大模型

下载

立即学习Java免费学习笔记(深入)”;

  • http:// 非本地非 HTTPS 页面调用 → 控制台无报错,但 start() 直接静默忽略
  • 未由用户手势触发 start()(例如在 setTimeout 或页面加载后自动调)→ Chrome 报错 NotAllowedError: Speech recognition permission denied
  • 用户未授麦克风权限 → onerror 触发,event.error === 'not-allowed',需引导用户手动开启
  • Firefox 宣称支持 SpeechRecognition,但实际未启用,typeof SpeechRecognition === 'undefined'
  • 移动端 Chrome(Android)支持,但 iOS Safari 完全不支持该 API,且无替代方案

替代方案:什么时候不该用 Web Speech API

如果你需要:离线识别、高准确率中文长句、实时流式识别、多语言混合、或支持 iOS —— Web Speech API 就不合适。

这时应考虑:

  • 调用后端 ASR 服务(如阿里云智能语音交互、腾讯云语音识别),前端只负责录音 + 上传音频 blob
  • 使用 WebAssembly 加载轻量级离线模型(如 @picovoice/porcupine 做唤醒词,配合 whisper.cpp wasm 版本做识别 —— 但延迟和资源占用高)
  • 接受限制:仅在桌面 Chrome/Edge 上提供语音输入入口,iOS 和 Firefox 用户降级为键盘输入

真正稳定的语音识别体验,从来不在浏览器单点 API 里,而在服务端能力 + 客户端合理兜底的组合里。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
chrome什么意思
chrome什么意思

chrome是浏览器的意思,由Google开发的网络浏览器,它在2008年首次发布,并迅速成为全球最受欢迎的浏览器之一。本专题为大家提供chrome相关的文章、下载、课程内容,供大家免费下载体验。

1057

2023.08.11

chrome无法加载插件怎么办
chrome无法加载插件怎么办

chrome无法加载插件可以通过检查插件是否已正确安装、禁用和启用插件、清除插件缓存、更新浏览器和插件、检查网络连接和尝试在隐身模式下加载插件方法解决。更多关于chrome相关问题,详情请看本专题下面的文章。php中文网欢迎大家前来学习。

838

2023.11.06

edge是什么浏览器
edge是什么浏览器

Edge是一款由Microsoft开发的网页浏览器,是Windows 10操作系统中默认的浏览器,其目标是提供更快、更安全、更现代化的浏览器体验。本专题为大家提供edge浏览器相关的文章、下载、课程内容,供大家免费下载体验。

1728

2023.08.21

IE浏览器自动跳转EDGE如何恢复
IE浏览器自动跳转EDGE如何恢复

ie浏览器自动跳转edge的解决办法:1、更改默认浏览器设置;2、阻止edge浏览器的自动跳转;3、更改超链接的默认打开方式;4、禁用“快速网页查看器”;5、卸载edge浏览器;6、检查第三方插件或应用程序等等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

397

2024.03.05

如何解决Edge打开但没有标题的问题
如何解决Edge打开但没有标题的问题

若 Microsoft Edge 浏览器打开后无标题(窗口空白或标题栏缺失),可尝试以下方法解决: 重启 Edge:关闭所有窗口,重新启动浏览器。 重置窗口布局:右击任务栏 Edge 图标 → 选择「最大化」或「还原」。 禁用扩展:进入 edge://extensions 临时关闭插件测试。 重置浏览器设置:前往 edge://settings/reset 恢复默认配置。 更新或重装 Edge:检查最新版本,或通过控制面板修复

1038

2025.04.24

scripterror怎么解决
scripterror怎么解决

scripterror的解决办法有检查语法、文件路径、检查网络连接、浏览器兼容性、使用try-catch语句、使用开发者工具进行调试、更新浏览器和JavaScript库或寻求专业帮助等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

492

2023.10.18

500error怎么解决
500error怎么解决

500error的解决办法有检查服务器日志、检查代码、检查服务器配置、更新软件版本、重新启动服务、调试代码和寻求帮助等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

382

2023.10.25

硬盘接口类型介绍
硬盘接口类型介绍

硬盘接口类型有IDE、SATA、SCSI、Fibre Channel、USB、eSATA、mSATA、PCIe等等。详细介绍:1、IDE接口是一种并行接口,主要用于连接硬盘和光驱等设备,它主要有两种类型:ATA和ATAPI,IDE接口已经逐渐被SATA接口;2、SATA接口是一种串行接口,相较于IDE接口,它具有更高的传输速度、更低的功耗和更小的体积;3、SCSI接口等等。

1925

2023.10.19

C# ASP.NET Core微服务架构与API网关实践
C# ASP.NET Core微服务架构与API网关实践

本专题围绕 C# 在现代后端架构中的微服务实践展开,系统讲解基于 ASP.NET Core 构建可扩展服务体系的核心方法。内容涵盖服务拆分策略、RESTful API 设计、服务间通信、API 网关统一入口管理以及服务治理机制。通过真实项目案例,帮助开发者掌握构建高可用微服务系统的关键技术,提高系统的可扩展性与维护效率。

76

2026.03.11

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
React 教程
React 教程

共58课时 | 6万人学习

TypeScript 教程
TypeScript 教程

共19课时 | 3.4万人学习

Bootstrap 5教程
Bootstrap 5教程

共46课时 | 3.6万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号