当前位置: 首页 > news >正文

wordpress插件证书认证网站app备案查询平台官网

wordpress插件证书认证网站,app备案查询平台官网,网站 建设方案,外贸购物网站目录 一、Whisper 1、Whisper介绍 2、安装Whisper 3、使用Whisper-base模型 4、使用Whisper-large-v3-turbo模型 二、vosk 1、Vosk介绍 2、vosk安装 3、使用vosk 三、总结 一、Whisper 1、Whisper介绍 Whisper 是一个由 OpenAI 开发的人工智能语音识别模型#xf…目录 一、Whisper 1、Whisper介绍 2、安装Whisper 3、使用Whisper-base模型 4、使用Whisper-large-v3-turbo模型 二、vosk 1、Vosk介绍 2、vosk安装 3、使用vosk 三、总结 一、Whisper 1、Whisper介绍 Whisper 是一个由 OpenAI 开发的人工智能语音识别模型它能够将语音转换为文本。Whisper 模型特别之处在于它的设计目标是能够理解和转录多种语言的语音包括但不限于英语。Whisper 模型在训练时使用了大量不同语言的语音数据这使得它具有很好的跨语言能力。 2、安装Whisper pip install openai-whisper# 安装ffmpeg sudo rpm --import http://li.nux.ro/download/nux/RPM-GPG-KEY-nux.ro sudo rpm -Uvh http://li.nux.ro/download/nux/dextop/el7/x86_64/nux-dextop-release-0-5.el7.nux.noarch.rpm sudo yum install ffmpeg3、使用Whisper-base模型 whisper.load_model方法会自动下载相应的模型可选[tiny.en, tiny, base.en, base, small.en, small, medium.en, medium, large-v1, large-v2, large-v3, large, large-v3-turbo, turbo]。 下面使用的测试音频放在了百度云可自行下载 百度云链接https://pan.baidu.com/s/16eGkDCOA02YbFY5V4ObZ1w?pwdsmr7  import whispermodel whisper.load_model(base) result model.transcribe(test.wav) print(result[text]) 识别结果如下 特大暴雨再次清洗滑南地區廣東清州與近日凌晨遭遇極端降雨短段數小時內每小時降雨量門增至40-50毫米以上至上50時清州12小時雷技雨量已經超過227毫米突破了最大暴雨標準同時刷新了當地5月份單日降雨記錄根據我國企項標準24小時降雨量超過50毫米定義為暴雨超100毫米為特大暴雨而超過255毫米則為特大特大暴雨 可通过opencc库将繁体字转换为简体字 pip install opencc-python-reimplemented import whisper from opencc import OpenCC# 初始化转换器从繁体中文转换到简体中文 converter OpenCC(t2s) model whisper.load_model(base) result model.transcribe(test.wav) print(converter.convert(result[text])) 识别结果如下 特大暴雨再次清洗滑南地区广东清州与近日凌晨遭遇极端降雨短段数小时内每小时降雨量门增至40-50毫米以上至上50时清州12小时雷技雨量已经超过227毫米突破了最大暴雨标准同时刷新了当地5月份单日降雨记录根据我国企项标准24小时降雨量超过50毫米定义为暴雨超100毫米为特大暴雨而超过255毫米则为特大特大暴雨 4、使用Whisper-large-v3-turbo模型 import whispermodel whisper.load_model(large-v3-turbo) result model.transcribe(test.wav) print(result[text]) 识别结果如下 特大暴雨再次侵袭华南地区广东,青州于近日凌晨遭遇极端降雨,短短数小时内每小时降雨量猛增至40-50毫米以上。至上午时时,青州12小时累计雨量已经超过227毫米,突破了最大暴雨标准,同时刷新了当地5月份单日降雨记录。根据我国气象标准,24小时降雨量超过50毫米定义为暴雨,超100毫米为特大暴雨,而超过250毫米则为特大特大暴雨。 可以看到large-v3-turbo模型比base模型的识别准确性更高并且识别结果为简体中文不用额外进行繁转简更加友好的是识别结果有标点符号可读性更强。 英文语音识别 import whispermodel whisper.load_model(large-v3-turbo) result model.transcribe(test_en.mp3) print(result[text]) 识别结果如下 In recent years, environmental conservation has become a topic of paramount importance. The rapid industrialization and urbanization have led to numerous environmental challenges, making it crucial for individuals, communities, and governments to take action. This article highlights the significance of environmental conservation and the measures that can be implemented to ensure a sustainable future. The environment provides essential resources for human survival, such as clean air, water, and fertile soil. Unfortunately, human activities have led to the depletion of these resources, causing adverse effects on both the ecosystem and human health. For instance, air pollution from factories and vehicles has resulted in respiratory problems, while water pollution has compromised access to clean drinking water. 二、vosk 1、Vosk介绍 Vosk 是一个开源的语音识别库它可以在离线环境下工作不依赖于任何外部服务。 Vosk 基于Kaldi语音识别框架支持多种语言包括中文。 Vosk提供了多种预训练模型可以根据需求选择适合的模型进行语音识别。Vosk的优势在于可以在没有网络连接的情况下进行语音识别并且支持多种操作系统和编程语言用户可以根据自己的需求训练和优化模型。 2、vosk安装 模型有small size也有较大的通用模型可自行下载需要的语言模型 https://alphacephei.com/vosk/models 以下下载的是大型通用中文模型vosk-model-cn-0.22.zip。 pip install vosk# 下载模型并解压 wget https://alphacephei.com/vosk/models/vosk-model-cn-0.22.zip unzip vosk-model-cn-0.22.zip 3、使用vosk import json import wave from vosk import Model, KaldiRecognizerdef recognize_wave(model, file_path):# 打开WAV音频文件with wave.open(file_path, rb) as wf:rate wf.getframerate() # 采样率frames wf.readframes(wf.getnframes()) # 读取所有帧rec KaldiRecognizer(model, rate)rec.SetWords(True)str_ret # 识别音频数据if rec.AcceptWaveform(frames):result json.loads(rec.Result())if text in result:str_ret result[text]result json.loads(rec.FinalResult())if text in result:str_ret result[text]str_ret .join(str_ret.split())return str_retif __name__ __main__:model Model(vosk-model-cn-0.22)file_path test.wav # 请确保文件名和路径正确res recognize_wave(model, file_path)print(res) 识别结果如下 特大暴雨再次侵袭华南地区广东青州于近日凌晨遭遇极端降雨短短数小时内每小时降水量猛增至四十到五十毫米以上是上午十时青州十二小时累计雨量已经超过二八二七毫米突破了最大暴雨标准同时刷新了当地五月份单日降雨纪录根据我国气象标准二十四小时长相雨量超过五十毫米定义为暴雨超一百毫米为特大暴雨而超过二百五十毫米则为特大特大暴雨 三、总结 Whisper由OpenAI开发其训练数据的多样性使得它在处理各种口音、背景噪音和专业术语方面具有较好的鲁棒性。large-v3-turbo是Whisper模型的一个改进版本在保持较高准确性的同时速度有了很大的提升这使得它在实时性要求较高的场景下非常有优势。如果需要快速准确地处理语音并且有足够的计算资源支持大型模型那么 large-v3-turbo 是很好的选择。 Vosk是一个轻量级的语音识别工具包基于Kaldi集成在处理一些复杂语言场景或特殊口音时可能相对 Whisper 会稍显不足。
http://www.w-s-a.com/news/268673/

相关文章:

  • 人员调动在网站上怎么做网站开发课程意见和建议
  • 卓训网是个什么网站wordpress命令执行时间
  • 网站建设需要做哪些工作网片焊接
  • 网站优化方案dedecms win8风格网站模板
  • 企业如何制作网站管理系统慈溪住房和城乡建设部网站
  • 青岛网站建设有哪些公司区块链网站开发价格
  • 怎么设置网站的logo微信公众号的h5网站开发6
  • 粉色的网站绍兴市建设局网站
  • 个人网站的基本风格是wordpress 模板选择
  • 南昌专业做网站公司有哪些广州市住房城乡建设部门户网站
  • 福州网站建设团队淘宝联盟网站怎么建设
  • 福州企业网站建站模板国内黑色风格的网站
  • 好看的网站首页设计android移动开发
  • 域名注册完成后如何做网站域名 删除 wordpress
  • wordpress xml导入大小东莞seo优化方案
  • 网站建设效益网站销售怎么做的
  • 利用网站空间做代理设计方案的格式范文
  • 无锡建设工程质量监督网站遵义做手机网站建设
  • 衡阳商城网站制作ps做网站首页规范尺寸
  • 微信网站应用开发营销推广的方案
  • 广州做网站商城的公司制作一个app的完整流程
  • 湖南城乡建设厅网站163注册企业邮箱
  • 做网站怎么调整图片间距织梦做的网站如何去掉index
  • 凡科网免费建站步骤及视频网页设计基础教程第二版课后答案
  • 建设一个旅游网站毕业设计企业网站要更新文章吗
  • 做网站需要简介中山网站设计公司
  • 网站怎么做导航栏微信公众号官网登录
  • 1_ 掌握网站开发的基本流程 要求:熟悉网站开发与设计的基本流程.电子商城网站开发
  • 百度网站怎么建设河北省工程造价信息网官网
  • 阿里云网站模板网页设计的合适尺寸是多少