新春大促,限时折扣

录音文件识别预付6折 后付7折
对用户上传的录音文件进行识别
特性:
  • 支持音频编码格式:PCM、OPUS
  • 支持多种语言的识别
  • 支持音频采样率:8000Hz、16000Hz
预付6折价 :¥10800元/10000小时
价         格:¥18000元/10000小时
实时语音转写预付6折 后付7折
可达到“边说边出文字”的效果
特性:
  • 支持音频编码格式:PCM
  • 支持音频采样率:8000Hz、16000Hz
  • 支持对返回结果进行设置
预付6折价 :¥15000元/10000小时
价         格:¥25000元/10000小时
语音合成预付6折 后付7折
将用户提交的文本转成流畅的语音
特性:
  • 支持输出PCM、WAV、MP3编码格式数据
  • 支持设置语速,语调,音量
  • 支持设置男声/女声
预付6折价 :¥15000元/10000千次
价         格:¥25000元/10000千次
一句话识别预付6折 后付7折
适用于较短的语音交互场景
特性:
  • 支持轮询方式和回调方式
  • 支持自学习平台和热词
  • 普通话、方言、欧美英语等多种模型识别
预付6折价 :¥15000元/10000千次
价         格:¥25000元/10000千次
语言模型自学习工具底价来袭
用户可上传数据,对阿里的语音技术深度定制
特性:
  • 颠覆性地提供一键式自助语音优化方案
  • 数分钟内完成专属定制模型的优化
  • 优化效果得到了充分验证
限时售价 :
¥800元/个/月

新春大促,限时折扣

录音文件识别预付6折 后付7折
对用户上传的录音文件进行识别
特性:
  • 支持音频编码格式:PCM、OPUS
  • 支持多种语言的识别
  • 支持音频采样率:8000Hz、16000Hz
预付6折价 :¥10800元/10000小时
价         格:¥18000元/10000小时
实时语音转写预付6折 后付7折
可达到“边说边出文字”的效果
特性:
  • 支持音频编码格式:PCM
  • 支持音频采样率:8000Hz、16000Hz
  • 支持对返回结果进行设置
预付6折价 :¥15000元/10000小时
价         格:¥25000元/10000小时
语音合成预付6折 后付7折
将用户提交的文本转成流畅的语音
特性:
  • 支持输出PCM、WAV、MP3编码格式数据
  • 支持设置语速,语调,音量
  • 支持设置男声/女声
预付6折价 :¥15000元/10000千次
价         格:¥25000元/10000千次
一句话识别预付6折 后付7折
适用于较短的语音交互场景
特性:
  • 支持轮询方式和回调方式
  • 支持自学习平台和热词
  • 普通话、方言、欧美英语等多种模型识别
预付6折价 :¥15000元/10000千次
价         格:¥25000元/10000千次
语言模型自学习工具底价来袭
用户可上传数据,对阿里的语音技术深度定制
特性:
  • 颠覆性地提供一键式自助语音优化方案
  • 数分钟内完成专属定制模型的优化
  • 优化效果得到了充分验证
限时售价 :
¥800元/个/月
x
一句话识别免费体验
语音录入
识别结果
0:00 / 1:00
点击“话筒”开始录音,请对我说你想说的话,我可以识别你说的内容哦~
请允许浏览器获取麦克风权限
产品优势
识别准确率高

国内独创的字级LC-BLSTM/DFSMN-CTC建模,相对业界传统CTC方法降低了20%的错误率,大幅提高了语音识别的精度

超快的解码速率

国内独创的LFR解码技术, 在不损失识别精度的情况下,将解码速率提高了3倍以上,大幅缩短了反馈时间,提升用户体验。

独创的模型优化工具

业内唯一一家提供自学习平台的系统。同时支持热词定制和模型定制。用户可以根据业务需求上传相关的数据,对各种语音产品进行定制,形成自己的专属模型,从而最大限度的提升识别效果。

广泛的领域覆盖

目前已经积累了大量行业客户,业务场景包括智能问答、智能质检、庭审记录、字幕翻译、语音助手等等。在金融、保险、司法、智能家居等多个领域均有成熟的应用案例。可以满足不同客户多样化的需求。

智能语音生态全新升级
语音合成

语音合成服务,通过先进的深度学习技术,将文本转换成自然流畅的语音。目前有多种音色可供选择,并提供 ..............................................................................................................................................调节语速、语调、音量等功能。适用于智能客服、语音交互、文学有声阅读和无障>碍播报等场景。

语音合成定制

为企业提供深度定制TTS声音的能力。通过先进的深度学习技术,用更少的数据量,更快速高效地为客户 .................................................................................................................................定制个性化语音合成声音。将自然流畅的TTS声音带到服务或设备上。

语言模型自学习工具

用户可以自行上传数据,对阿里的语音技术进行深度定制,从而提升特定业务领域的识别准确度。目前 ........................................................................................................仅支持上传文本数据对语言模型进行定制,未来会推出上传音频数据对声学模型进行定制。

应用场景

法庭庭审转写

智能客服质检

实时直播字幕及监控

业务电话内容监控

  • 法庭庭审转写
  • 智能客服质检
  • 实时直播字幕及监控
  • 业务电话内容监控

法庭庭审转写方案

将庭审过程中的法官、被告等角色所说的话实时转写成文字,从而替代了书记员的角色。阿里云智能法庭方案已经覆盖上百法庭,经过千次庭审的洗礼,得到广泛好评。合作客户包括浙江省全省法院、北京知识产权法院等。

业务痛点及需求

之前主要通过书记员对庭审过程进行记录,记录下来的文字会带有书记员的理解和归纳。智能语音识别技术可以将庭审各方的语音直接转变为文字,供各方在庭审页面上查看,并可作为庭审笔录直接使用。

优势

1. 积累了大量司法方面数据,转写效果佳;
2. 全国首次在庭审中使用语音识别,正确率超过97%;
3. 支持专有云部署;
4. 对于特殊关键词,如人名等,可以分庭做词表导入,以优化识别准确率。

智能客服质检

传统质检一般是对客服电话录音以人工听的方式进行检查,存在效率问题以及人员瓶颈。智能质检能够对所有服务过程进行全量的实时质检,帮助企业的服务部门摆脱人的限制,全面把控服务质量。

使用流程

将待检的语音数据转换成文本之后,通过质检引擎产生质检结果,并生成统计数据。质检人也可以在管控台上定位查看到每条数据命中的规则点、以边听边看的方式对结果进行校验。

优势

1. 全量自动化——能实现全量客服通话、工单的自动化质检;
2. 实时性——能做到电话一挂立即完成质检,实时看到最新的结果;
3. 规则灵活性——规则配置超灵活,覆盖到各类复杂的业务场景。

实时直播字幕及监控

现场演讲场景、直播场景下,将视频中的音频实时转写成字幕。在直播场景下,还可以进一步对内容进行监控。

业务痛点及需求

1. 在开大会做演讲时,现场环境如果比较嘈杂,座位靠后或远程做直播时,可能会听不清演讲内容;
2. 一个直播APP,每天产生的视频数量多达数十万小时。严肃直播有字幕需求,娱乐直播有监控需求。

优势

1. 在阿里云栖大会现场做了演讲的转写,在正确率上击败国际速记比赛亚军,目前已经成为云栖大会的标配产品;
2. 实时转写速度极快,几乎与直播同步。

业务电话内容监控

传统中介业务中容易出现客户双方建立联系后抛弃中介的事情,如房东诱导房客进行线下交易,从而导致中介公司经济损失。这类行为往往发生在双方沟通的电话中。通过阿里云语音识别服务,可以帮助中介及时的发现上述问题,从而阻止逃单行为,避免经济损失。

使用流程

将电话实时传给阿里云的语音转文本接口,阿里云将及时返回数据,客户可使用阿里云的质检系统或者自建分析系统对返回的文字做分析,从而及时发现问题。

优势

1. 无需人工介入,减少人力成本;
2. 实时性好,可以及时发现问题。