浏览不同技术领域的内容,找到您需要的语音技术解决方案
基于深度学习的端到端语音识别技术,支持实时语音转文字、离线识别、多语种混合识别等场景。
本文深入探讨蝌蚪语音在端到端语音识别模型中的技术创新,包括数据增强、模型结构优化和语言模型融合等关键技术。
构建低延迟、高并发的实时语音识别服务,分享蝌蚪语音在流式处理、负载均衡和弹性伸缩方面的工程经验。
介绍蝌蚪语音在多语种语音识别方向的最新进展,包括语言识别、代码切换和低资源语言迁移学习等技术。