EasyChat logoEasyChat

实时语音识别

支持实时语音识别功能,用户可通过 EasyChat 识别系统正在播放的 音频/视频 内容,并将识别结果翻译为目标语言作为字幕形式显示在屏幕上,支持 10 种语言的识别。

使用方法

注意

目前实时语音识别的 ASR 模型已支持应用内下载(下载源为 Github),中国大陆地区用户可能会因为网络问题导致下载失败,可在 设置->常规->网络代理 中配置代理后再尝试下载,或使用如 Watt Toolkit 等工具加速 Github 下载;
也可手动导入通过 GithubGoogle 硬盘QQ 交流群 中群文件下载的模型。

  1. 设置->语音->ASR 模型 下载或导入您需要的 ASR 模型。 ASR 模型设置

  2. 转至 语音识别 页面,选择好配置项,点击 开始识别 按钮,并开启字幕悬浮窗,EasyChat 将自动识别系统正在播放的音频/视频内容,并将识别结果翻译为目标语言作为字幕形式显示在屏幕上。

    下方音频源选项中可以选择仅对指定的进程进行识别

    语音识别 语音识别

支持的语言

目前支持 10 种识别语言,每种语言均有独立的 ASR 模型。请在使用该功能前下载相应的模型。

语言代码
英语en-US
简体中文zh-CN
日语ja-JP
韩语ko-KR
德语de-DE
丹麦语da-DK
西班牙语es-ES
法语fr-FR
意大利语it-IT
葡萄牙语pt-PT

使用场景

“生肉”视频与海外直播观看

观看 YouTube、Twitch 等平台无官方字幕的外语视频或实时直播时,EasyChat 能实时将系统声音转化为你熟悉的语言,并以悬浮字幕的形式显示在屏幕上,让你第一时间获取前沿资讯和娱乐内容。

跨国线上会议与远程网课

在使用 Zoom、Teams 开会或参与海外名校公开课时,开启实时识别并指定会议软件进程,即可获得纯净的会议实时翻译字幕,避免被其他软件的声音干扰。再也不用担心听漏关键信息,轻松应对跨语言听讲。

播客与纯音频内容可视化

在电脑上收听全外文的播客(Podcast)、有声书或访谈录音时,通过实时生成的翻译字幕,可以将纯听觉的音频内容转化为可视化的文本,大幅降低理解门槛,不错过任何精彩观点。

沉浸式外语听力辅助

作为外语学习者的得力助手。在观看原声影视剧或播放听力材料时,悬浮字幕可以作为实时的母语参考,帮助你快速对照发音与释义,在沉浸式环境中有效提升外语听觉敏锐度。

On this page