当前位置: 首页 > news >正文

西安知名高端网站建设服务企业中国包装设计网

西安知名高端网站建设服务企业,中国包装设计网,郑州网站制作公司排名,对外网站建设情况汇报使用openai-whisper实现语音转文字 1 安装依赖 1.1 Windows下安装ffmpeg FFmpeg是一套可以用来记录、转换数字音频、视频,并能将其转化为流的开源计算机程序。采用LGPL或GPL许可证。它提供了录制、转换以及流化音视频的完整解决方案。 # ffmpeg官网 https://ffm…

使用openai-whisper实现语音转文字

1 安装依赖

1.1 Windows下安装ffmpeg

FFmpeg是一套可以用来记录、转换数字音频、视频,并能将其转化为流的开源计算机程序。采用LGPL或GPL许可证。它提供了录制、转换以及流化音视频的完整解决方案。

# ffmpeg官网
https://ffmpeg.org/# ffmpeg下载地址
https://ffmpeg.org/download.html# 点击下载后会进入github,地址如下
https://github.com/BtbN/FFmpeg-Builds/releases

在官网上选择windows版本

在这里插入图片描述

推荐使用ffmpeg-n5.1.4-win64-gpl-5.1.zipffmpeg-n6.0.1-win64-gpl-6.0.zip这两个版本,因为ffmpeg 5.1.4 和 ffmpeg 6.0.1版本是最新稳定版。

#  Auto-Build 2023-11-30的地址
https://github.com/BtbN/FFmpeg-Builds/releases/tag/autobuild-2023-11-30-12-55# ffmpeg-n5.1.4-win64-gpl-5.1.zip的地址
https://github.com/BtbN/FFmpeg-Builds/releases/download/autobuild-2023-11-30-12-55/ffmpeg-n5.1.4-win64-gpl-5.1.zip# ffmpeg-n6.0.1-win64-gpl-6.0.zip的地址
https://github.com/BtbN/FFmpeg-Builds/releases/download/autobuild-2023-11-30-12-55/ffmpeg-n6.0.1-win64-gpl-6.0.zip

在GitHub上可以选择最新版本,选择ffmpeg-master-latest-win64-gpl.zip

⚠️​ 如果python程序出现“FileNotFoundError: [WinError 2] 系统找不到指定的文件。”错误时,可能是ffmpeg版本的问题。

在这里插入图片描述

ffmpeg-master-latest-win64-gpl.zip 解压到D盘,名字修改为ffmpeg, 将目录 D:\ffmpeg\bin 添加到环境变量中。

在这里插入图片描述

在dos页面查看版本号中输入:ffmpeg.exe -version,出现下面的信息表示安装成功。

在这里插入图片描述

1.2 安装openai-whispe

# whispe地址
https://github.com/openai/whisper# 安装openai-whisper
pip install openai-whisper -i https://pypi.tuna.tsinghua.edu.cn/simple# 安装pydub切割音频,防止音频太长
pip install pydub -i https://pypi.tuna.tsinghua.edu.cn/simple

下载语音,可以直接在浏览器中打开,再下载

wget -c https://paddlespeech.bj.bcebos.com/PaddleAudio/zh.wav
wget -c https://paddlespeech.bj.bcebos.com/PaddleAudio/en.wav

2 使用openai-whispe

2.1 工程目录

在这里插入图片描述

2.2 main.py

import whisper
model = whisper.load_model(name="tiny", download_root="./model")# load audio and pad/trim it to fit 30 seconds
audio = whisper.load_audio(".//data//zh.wav")
audio = whisper.pad_or_trim(audio)# make log-Mel spectrogram and move to the same device as the model
mel = whisper.log_mel_spectrogram(audio).to(model.device)# detect the spoken language
_, probs = model.detect_language(mel)
print(f"Detected language: {max(probs, key=probs.get)}")# decode the audio
options = whisper.DecodingOptions()
result = whisper.decode(model, mel, options)# print the recognized text
print(result.text)

输出结果:

Detected language: zh
我認為跑步最重要的就是給我帶來了身體健康
http://www.yayakq.cn/news/768047/

相关文章:

  • 品牌营销推广公司合肥seo排名优化公司
  • 网站更新网站上360 旋转的图是怎么做的
  • 企业网站app建立音乐网站
  • 百合视频做爰视频网站平面设计在线网站
  • 这里是我做的网站大同建设网站
  • 阜阳网站建设费用成为短视频的app有哪些
  • 豫建设标去哪个网站优化教程网
  • 开家网站设计公司扬州网站开发公司
  • 网站怎么能快速备案农产品线上推广方案
  • 档案网站建设论文做网站应该注意些什么问题
  • phpwind网站微网站需要什么
  • 我的世界做图的网站360网站认证域名
  • 牡丹区建设局网站网站页面优化包括
  • 腾讯云cdn wordpress一个网站两个域名 seo
  • 网站建设要后台吗平板python编程软件
  • 网站设计集团企业网站seo推广技巧
  • 您在工信部门备案网站获取的icp备案号wordpress对比
  • html成品网站广州大学生网页设计大赛
  • 苏州网站建设seoui设计的基本流程图
  • 做坏事小视频网站广东省做农业网站公司
  • 多媒体网站开发实验报告大二网页设计作业成品
  • 网网站建设站建设惠州做网站开发
  • 创建免费网站深圳进入政策最新
  • 网站模板样式修改成都到西安
  • 综合门户型网站有哪些uemo网站源码
  • 西宁网络公司网站建设许昌网站seo
  • 昆山网站制作 微博中小企业网站
  • 一个网站是怎么建立的常州建设企业网站
  • 蛋糕网站设计装修步骤和流程
  • 网站tag标签贵阳seo网站推广技巧