跳至主要内容

更新历史

本页面列出了 AmiVoice API 和本手册的主要更新历史。除了这里列出的内容之外,还会不定期进行一些小的更新和修正。

AmiVoice API 的主要功能更新历史

AmiVoice API 现已支持 AWS PrivateLink,可在不经过互联网的情况下在 AWS 网络内进行连接。通过在客户的 VPC 内创建的接口端点,可以使用与以往相同的 API key 来使用语音识别、用户词典操作、API key 发行等各项 API。使用前需要事先申请。

详情请参阅私有连接(AWS PrivateLink)

2026-08-12:情感分析功能在异步 HTTP 接口 v2 上发布

情感分析功能此前仅在异步 HTTP 接口的 v1 上提供,此次在异步 HTTP 接口的 v2 上也可以使用了。

v1 和 v2 在使用方法、参数的指定方法以及响应整体的结构上基本相同,但情感分析引擎的版本不同,即使处理相同的音频,情感参数的值也不会完全相同。这是由于情感分析引擎的更新所致,参数所表示的情感的定义没有变化。从 v1 迁移到 v2 时,请注意这一点。

此外,在异步 HTTP 接口的 v1 上,在提供终止之前,仍可与 v2 并行继续使用情感分析功能。

2026-07-28:MyPage 显示变更(部分用户)

针对 2025-06-30 MyPage 改版后创建的账户,我们已将 MyPage 的"Connection Information"中显示的 Service ID 及 Service Password 切换为隐藏。这些信息此前作为在API key 发行 API中用于认证的凭据提供,今后请使用在 MyPage 上启用"API key 发行功能"后发行的 API key。

Service ID 和 Service Password 在不删除账户的情况下无法更改。因此,为了降低认证信息泄露的风险,我们停止了在 MyPage 上的显示。

此外,对于 MyPage 改版之前创建的账户,仍会继续在"Connection Information"中显示。由于无法更改,请充分注意其处理。

2026-07-23:开始在 Statuspage 上通过定期执行自动测试来检测语音识别引擎的部分中断

此前我们也一直监控语音识别服务器的日志,自动检测内部服务器之间的通信错误,并作为"接続障害(连接故障)"显示在 Statuspage 上。但仅靠这种方法,无法充分检测出由内部通信错误以外的原因导致客户端无法获取语音识别结果的情况。

此次,我们新增了与实际使用相同、从外部向各语音识别引擎定期发送测试语音并确认能否正常获取识别结果的 E2E 测试。由此强化了部分中断的自动检测。

如果由于某种原因导致语音识别引擎持续不返回识别结果,我们会自动检测该状况并显示在 Statuspage 上。

2026-05-28:发布新功能和请求参数

发布了在单词级别的识别结果中获取语言标签的功能。可以通过请求参数"segmenterProperties"中的useLid来启用此功能。

此外,新增了指定识别结果置信度阈值的参数"confidenceLevel",以及"音声入力_ルール"引擎专用的参数"completeTimeout"和"wildcardModelPenalty"。

另外,对现有参数进行了功能修改,maxResponseTimetargetResponseTime仅对实时语音识别有效,maxDecodingRatetargetDecodingRate仅对录音文件的批处理有效。

2026-03-02:更新客户端库

发布了客户端库的 1.1.12 版本,该版本支持 AmiVoice API 新发布的功能,并适配了各种编程语言的新版本。

2026-02-16:发布 End to End 引擎的单词强调功能

End to End 引擎的"单词强调"功能已发布。这是类似于 Hybrid 引擎中"单词注册"的功能,用于使难以识别的单词更容易被识别。

同时,随着这次发布,我们将"单词注册"和"单词强调"这两个功能统称为"用户词典"。

2025-11-18:发布语音识别处理相关的新功能,以及获取单词注册配置文件列表的功能

发布了多项与语音识别处理相关的新功能,并添加了请求参数来启用这些功能,包括maxDecodingTimemaxResponseTimemaxDecodingRatetargetResponseTimetargetDecodingRaterecognitionTimeoutnoInputTimeout

此外,用户单词注册 API 中新增了获取 profile 列表

2025-10-31:"使用量统计标签"支持异步 HTTP 接口的 v2 版本

使用量统计标签现在也支持异步 HTTP 接口的 v2 版本,可以在所有接口中使用。

2025-10-02:多语言 End to End 引擎的识别结果添加语言标签

多语言End to End 引擎的单词级识别结果中,现在会输出表示引擎识别出的单词语言的标签。详情请参考单词级结果中的results[0].tokens[].language

2025-09-30:发布新功能"使用量统计标签"

发布了使用量统计标签,使得在共用同一账户时可以按属性获取使用量。 但是,异步 HTTP 接口的 v2 版本目前还不支持此功能。

2025-08-13:支持存储在 WebM 容器中的 Opus 音频数据

AmiVoice API 现在也支持存储在 WebM 容器中的 Opus 音频数据。详情请参考带 header 的音频格式

2025-06-23:单词注册 API 支持 8k 音频

单词注册 API 现在可以操作 8k 音频用的配置文件。详情请参考用户单词注册中各种操作说明的"请求参数"中的adf

手册的主要更新历史

2026-08-04:发布使用 Rule Grammar 时的指定方法

发布了在使用 AmiVoice API Private 中可用的"音声入力_ルール"引擎(-a-rule-input-private)时,指定语音识别请求中使用的 Rule Grammar 的方法。此外,配合此次更新,我们整理了 Rule Grammar 相关信息的发布位置结构。

发布位置:Rule Grammar下的Grammar 文件指定方法

2026-07-22:新增安全相关信息

新增了 AmiVoice API 的安全相关内容,包括信用卡支付信息以及责任分界。

位置:Service 规格

2026-07-10:发布面向生成式 AI・编程 Agent 的指南

1. 索引文件llms.txt的公开

公开llms.txt,这是一个面向 AI 的索引文件,汇总了主要 API 规格及各种文档的链接和概要。AI Agent 首先读取该文件,即可以最短路径访问所需信息。

2. 提供 Markdown 版文档

在所有文档页面中,我们支持以便于 AI 解释并兼顾减少 token 的纯 Markdown 格式输出。可通过以下任一方法获取。

  • 在各文档页面 URL 的末尾附加.md进行请求。
  • 在 HTTP 请求时附加Accept: text/markdown header 进行请求。

为使 AI 爬虫和 Agent 能够自动检测这些资源,我们在通常的 HTML 页面响应的 HTTP header 中附加了指示对应 Markdown 版 URL 和llms.txt位置的 Link header。

4. 向开发者介绍活用方法

我们发布了关于活用上述新功能、使用生成式 AI 和编程 Agent 进行开发时的 AmiVoice API 活用方法的指南。

发布位置:使用生成式 AI 进行开发

2026-07-09:将 API 参考从手册中分离

我们将 AmiVoice API 的参考从手册中分离出来,改为可从专用标签页查看。对于 HTTP 接口的 API,已迁移到从 OpenAPI 格式的规格书自动生成的参考。这样一来,不仅可以随时确认最新的规格,还可以将规格直接导入各种开发工具。

发布位置:参考

2026-06-26:发布在 WebSocket 接口中通过 HTTP 请求 header 发送认证信息的方法

在 WebSocket 接口中,发布了将认证信息(API Key)写入 WebSocket 连接时的 HTTP 请求 header 中发送,而非在 WebSocket 连接后的s命令内发送的方法。

发布位置:在 HTTP 请求 header 中发送认证信息的方法

2026-06-12:发布用户词典的"快速入门"

发布了用户词典功能的快速入门,以便用户可以快速尝试此功能。

发布位置:用户词典

2026-06-08:新增使用条款和 SLA 页面

将使用条款和 SLA 新增为手册的单独标签,并提供了更新历史和部分过去版本供参考。

发布位置:AmiVoice API Terms of Service/SLA(英语)

2026-05-08:发布关于 MyPage 的信息

发布了关于 AmiVoice API MyPage 的信息。

发布位置:MyPage (管理界面)操作

2026-04-14:将"APPKEY"改名为"API key"

我们将使用 AmiVoice API 时进行认证所需的"服务认证 key 字符串"的名称从"APPKEY"改为"API key"。同时,我们也将之前称为"一次性 APPKEY"的统一改为"API key"。我们还添加了关于 API key 的说明页面,并对手册的结构进行了部分调整。

发布位置:API Key及其子页面

此外,我们修正了 API key 发行 API 参考文档中关于使用错误的 service ID 或 service password 发行的 API key 时的错误消息描述的错误。

发布位置:API Key 发行中的"注意"部分

2026-04-03:发布语音检测相关请求参数调整的参考信息

我们发布了请求参数segmenterProperties中与语音检测相关的参数的使用场景推荐值和调整示例。

发布位置:推荐值在segmenterProperties,参数调整示例在语音检测参数调整

2026-03-24:发布用户词典数据处理相关信息

作为 AmiVoice API 服务规格的一部分,我们发布了关于用户词典数据处理的信息。

发布位置:服务规格中的用户词典数据处理,以及日志保存选项和数据提供

2026-03-12:"入门"页面更新

我们更新了"入门"页面,添加了快速入门指南,使用户能更轻松地开始使用 AmiVoice API。原有的教程已整合到各个接口的使用说明页面中。

发布位置:入门(Quick Start)

2026-03-11:发布服务规格信息

我们发布了 AmiVoice API 的安全性等服务规格信息。

发布位置:服务规格

2026-01-08:发布故障信息通知邮箱设置方法

我们发布了设置 AmiVoice API 故障信息邮件通知接收邮箱的方法。同时,我们也对手册的结构进行了部分调整。

发布位置:故障信息通知设置

2025-12-10:修正说话人分类相关参数的默认值

发布位置:segmenterProperties中的"说话人分类相关参数",说话人分类的调整说话人检测的敏感度

2025-12-02:添加 Statuspage 信息

添加了提供 AmiVoice API 故障和延迟信息的 Statuspage 相关信息。

发布位置:故障和延迟信息

2025-10-01:添加规则语法的信息

添加了关于AmiVoice API Private中可用的"音声入力_ルール"引擎(-a-rule-input-private)使用的语法文件的信息。

发布位置:Rule Grammar

2025-08-13:添加segmenterProperties的信息

添加了关于请求参数segmenterProperties中用于调节语音识别的发话区间检测的参数的信息。

发布位置:segmenterProperties中的"发话区间检测参数"