sample-code_-aicaption-arkts:基于 HarmonyOS 的 AI 字幕演示项目

本示例基于场景化语音服务能力,提供了将音频文件识别为文字的服务。

分支1Tags0
文件最后提交记录最后更新时间
2 年前
4 个月前
2 年前
1 年前
4 个月前
4 个月前
2 年前
2 年前
2 年前
4 个月前
4 个月前

实现AI字幕

介绍

本示例展示了语音类AI能力中的AI字幕能力。

本示例模拟了在应用里,通过依次点击"切换字幕显示状态"->"读取pcm音频"按钮,拉起AI字幕控件并对音频进行实时语音转文字的场景。

需要使用HiAI引擎框架中的@kit.SpeechKit.d.ts接口。

效果预览

工程目录

├─entry/src/main/ets                         // 代码区
│  ├─entryability
│  │  └─EntryAbility.ets                     // EntryAbility
│  └─pages
│     └─Index.ets                            // 主页界面
├─entry/src/main/resources                   // 应用资源目录
│  └─chineseAudio.pcm                        // pcm音频文件
└─screenshots                                // 截图

具体实现

本示例模拟了在应用里,通过依次点击"切换字幕显示状态"->"读取pcm音频"按钮,拉起AI字幕控件并对音频进行实时语音转文字的场景。 业务使用时,需要先进行import导入Speech kit: import { AICaptionComponent, AICaptionOptions, AICaptionController, AudioData } from '@kit.SpeechKit';

涉及接口:

涉及组件:

具体参考entry/src/main/ets/pages/Index.ets.

相关权限

约束与限制

  1. 本示例仅支持标准系统上运行,支持设备:Phone、Tablet、2in1。
  2. HarmonyOS系统:HarmonyOS 5.0.5 Release及以上。
  3. DevEco Studio版本:DevEco Studio 6.1.0 Release及以上。
  4. HarmonyOS SDK版本:HarmonyOS 6.1.0 Release SDK及以上。

项目介绍

本示例基于场景化语音服务能力,提供了将音频文件识别为文字的服务。

定制我的领域