Speech框架详细解析（一） —— 基本概览

版本记录

版本号	时间
V1.0	2018.02.04

前言

Speech框架，在用户允许的情况下，获得对现场和预先录制的语音的识别，并获得转录，替代解释和置信度。接下来几篇我们就一起看一下这个框架。

Overview

下面我们就看一下该框架的基本信息。

iOS用户习惯于使用Siri与应用进行交互，并在键盘可见时使用听写来捕捉他们的语音。 Speech API允许您在应用程序中扩展和增强语音识别体验，而不需要键盘。

下面看一下该框架的基本结构。

Getting Started with Speech Recognition - 开始语音识别

Speech API通过与Apple服务器通信或使用设备上的语音识别器（如果可用）来执行语音识别。要找出语音识别器是否可用于特定语言，请使用SFSpeechRecognizerDelegate协议。

由于您的应用可能需要连接到服务器才能执行识别，因此尊重用户的隐私并将其话语视为敏感数据是非常重要的。因此，在启动语音识别之前，您必须获得用户的明确许可。

注意：如果用户授予权限，则不必再次请求。

要开始在您的应用程序中使用语音识别：

1. 写一个句子，告诉用户他们如何在你的应用程序中使用语音识别。

例如，如果您的待办事项列表应用程序在用户说完“done”时将项目的状态更改为完成，则可以编写“Lets you mark an item as finished by saying Done”。

1. 将NSSpeechRecognitionUsageDescription关键字添加到Info.plist文件中，并将您所写的句子作为字符串值提供。
1. 使用requestAuthorization:通过显示您在警报中编写的句子来请求用户的权限。

如果用户拒绝许可（或者语音识别不可用），请妥善处理。例如，您可能会禁用指示语音识别可用性的用户界面项目。

1. 在用户授予您的应用程序执行语音识别权限后，创建一个SFSpeechRecognizer对象并创建一个语音识别请求。

使用SFSpeechURLRecognitionRequest类对预先记录的磁盘上的音频文件执行识别，并使用SFSpeechAudioBufferRecognitionRequest类识别实时音频或内存中的内容。

1. 将请求传递给SFSpeechRecognizer对象以开始识别。

语音是逐渐识别的，所以你的识别器的处理程序可能会被多次调用。（检查识别完成时final属性的值。）如果您正在使用实时音频，则在识别过程中使用SFSpeechAudioBufferRecognitionRequest并将音频缓冲区附加到请求。

1. 录制完成后，向识别器发出信号，指示没有更多音频，以便识别可以完成。请注意，在前一个完成之前启动新的识别任务会中断正在进行的任务。

Creating a Speech Recognizer - 创建一个语音识别器

这是创建一个简单的识别器的方法，默认为用户当前的语言环境并启动语音识别。

// Listing 1 Getting a speech recognizer and making a recognition request

func recognizeFile(url:NSURL) {
   guard let myRecognizer = SFSpeechRecognizer() else {
      // A recognizer is not supported for the current locale
      return
   }   if !recognizer.isAvailable() {
      // The recognizer is not available right now
      return
   }   let request = SFSpeechURLRecognitionRequest(url: url)
   recognizer.recognitionTask(with: request) { (result, error) in
      guard let result = result else {
         // Recognition failed, so check error for details and handle it
         return
      }
      if result.isFinal {
         // Print the speech that has been recognized so far
         print("Speech in the file is \(result.bestTranscription.formattedString)")
      }
   }}

Best Practices for a Great User Experience - 良好用户体验的最佳实践

Be prepared to handle the failures that can be caused by reaching speech recognition limits.准备好处理可能由于达到语音识别限制而导致的故障。由于语音识别是一种基于网络的服务，所以强制执行限制，以便服务可以免费供所有应用程序使用。单个设备可能会受限于每天可以执行的识别次数，并且可能会根据每天请求的数量在全局范围内对单个应用程序进行限制。例如，如果识别请求快速失败（在开始的一两秒钟内），则识别服务可能暂时不可用于您的应用程序，并且您可能要求用户稍后再试。
Plan for a one-minute limit on audio duration.规划音频持续时间的一分钟限制。语音识别会给电池寿命和网络使用带来相对较高的负担。在iOS 10中，话语音频持续时间被限制在一分钟左右，这与键盘相关听写的限制相似。
Remind the user when your app is recording.在应用程序正在录制时提醒用户。例如，您可以播放“正在录制”的声音，并显示可帮助用户了解他们正在被主动录制的视觉指示器。您还可以在识别时显示语音，以便用户了解您的应用正在做什么以及发生识别错误的时间。
Do not perform speech recognition on private or sensitive information.不要对私人或敏感信息进行语音识别。有些言论根本不适合识别。避免发送密码，健康或财务数据，以及其他敏感的言论进行识别。

Topics

1. Getting a Speech Recognizer

SFSpeechRecognizer
- 支持的语音识别器

2. Requesting Recognition and Monitoring Progress

SFSpeechAudioBufferRecognitionRequest
- 识别音频缓冲区中提供的语音的请求。
SFSpeechRecognitionRequest
- 从音频源中识别语音的请求。
SFSpeechURLRecognitionRequest
- 在录制的音频文件中识别语音的请求。
SFSpeechRecognitionTask
- 语音识别任务，让您监视识别进度。

3. Working with Recognition Results and Transcriptions

SFSpeechRecognitionResult
- 被识别的话语，对应于一段录制的语音，并包含一个或多个转录言语。
SFTranscription
- 被识别的言语的虚拟文本表示。
SFTranscriptionSegment
- 整个言语的转录的一部分。
SFSpeechRecognitionTaskDelegate
- 支持复杂或多个话语语音识别请求的协议。
SFSpeechRecognizerDelegate
- 协议可以帮助您跟踪语音识别器的可用性。

4. Constants

Speech Enumerations
- 指定语音识别类型的常量，识别任务的状态以及授权请求的状态。

后记

本篇已结束，后面更精彩~~~

人面猴
序言：七十年代末，一起剥皮案震惊了整个滨河市，随后出现的几起案子，更是在滨河造成了极大的恐慌，老刑警刘岩，带你破解...
沈念sama阅读 194,491评论 5赞 459
死咒
序言：滨河连续发生了三起死亡事件，死亡现场离奇诡异，居然都是意外死亡，警方通过查阅死者的电脑和手机，发现死者居然都...
沈念sama阅读 81,856评论 2赞 371
救了他两次的神仙让他今天三更去死
文/潘晓璐我一进店门，熙熙楼的掌柜王于贵愁眉苦脸地迎上来，“玉大人，你说我怎么就摊上这事。” “怎么了？”我有些...
开封第一讲书人阅读 141,745评论 0赞 319
道士缉凶录：失踪的卖姜人
文/不坏的土叔我叫张陵，是天一观的道长。经常有香客问我，道长，这世上最难降的妖魔是什么？我笑而不...
开封第一讲书人阅读 52,196评论 1赞 263
港岛之恋（遗憾婚礼）
正文为了忘掉前任，我火速办了婚礼，结果婚礼上，老公的妹妹穿的比我还像新娘。我一直安慰自己，他们只是感情好，可当我...
茶点故事阅读 61,073评论 4赞 355
恶毒庶女顶嫁案：这布局不是一般人想出来的
文/花漫我一把揭开白布。她就那样静静地躺着，像睡着了一般。火红的嫁衣衬着肌肤如雪。梳的纹丝不乱的头发上，一...
开封第一讲书人阅读 46,112评论 1赞 272
城市分裂传说
那天，我揣着相机与录音，去河边找鬼。笑死，一个胖子当着我的面吹牛，可吹牛的内容都是我干的。我是一名探鬼主播，决...
沈念sama阅读 36,531评论 3赞 381
双鸳鸯连环套：你想象不到人心有多黑
文/苍兰香墨我猛地睁开眼，长吁一口气：“原来是场噩梦啊……” “哼！你这毒妇竟也来了？” 一声冷哼从身侧响起，我...
开封第一讲书人阅读 35,215评论 0赞 253
万荣杀人案实录
序言：老挝万荣一对情侣失踪，失踪者是张志新（化名）和其女友刘颖，没想到半个月后，有当地人在树林里发现了一具尸体，经...
沈念sama阅读 39,485评论 1赞 290
护林员之死
正文独居荒郊野岭守林人离奇死亡，尸身上长有42处带血的脓包…… 初始之章·张勋以下内容为张勋视角年9月15日...
茶点故事阅读 34,578评论 2赞 309
白月光启示录
正文我和宋清朗相恋三年，在试婚纱的时候发现自己被绿了。大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
茶点故事阅读 36,356评论 1赞 326
活死人
序言：一个原本活蹦乱跳的男人离奇死亡，死状恐怖，灵堂内的尸体忽然破棺而出，到底是诈尸还是另有隐情，我是刑警宁泽，带...
沈念sama阅读 32,215评论 3赞 312
日本核电站爆炸内幕
正文年R本政府宣布，位于F岛的核电站，受9级特大地震影响，放射性物质发生泄漏。R本人自食恶果不足惜，却给世界环境...
茶点故事阅读 37,583评论 3赞 299
男人毒药：我在死后第九天来索命
文/蒙蒙一、第九天我趴在偏房一处隐蔽的房顶上张望。院中可真热闹，春花似锦、人声如沸。这庄子的主人今日做“春日...
开封第一讲书人阅读 28,898评论 0赞 17
一桩弑父案，背后竟有这般阴谋
文/苍兰香墨我抬头看了看天上的太阳。三九已至，却和暖如春，着一层夹袄步出监牢的瞬间，已是汗流浃背。一阵脚步声响...
开封第一讲书人阅读 30,174评论 1赞 250
情欲美人皮
我被黑心中介骗来泰国打工，没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留，地道东北人。一个月前我还...
沈念sama阅读 41,497评论 2赞 341
代替公主和亲
正文我出身青楼，却偏偏与公主长得像，于是被迫代替她去往敌国和亲。传闻我的和亲对象是个残疾皇子，可洞房花烛夜当晚...
茶点故事阅读 40,697评论 2赞 335