
Whisper本地语音转文字工具是一款本地的语音转文字的工具,能够辅助个人用户通过模型的方式来完成本地的语音对文字上面的转换,你需要导入模型进行识别之后才能够进行转换,完全本地化的运行,无需网络就能够使用,快来西西下载这款Whisper本地语音转文字工具!

这个项目是whisper.cpp实现的一个Windows移植。
它又是OpenAI的Whisper自动语音识别(ASR)模型的C++移植。
基于DirectCompute的供应商无关的GPGPU;该技术的另一个名称是 "Direct3D 11的计算着色器"
纯粹的C++实现,除了基本的操作系统组件,没有运行时的依赖性
比OpenAI的实现快得多。
在我的台式电脑上,使用GeForce 1080Ti GPU,中等型号,3:24分钟的演讲用PyTorch和CUDA抄写需要45秒,但用我的实现和DirectCompute只需要19秒。
有趣的是:这相当于9.63GB的运行时依赖,而Whisper.dll只有431KB。
混合F16/F32精度。Windows要求从D3D 10.0版本开始支持R16_FLOAT缓冲区。
内置性能分析器,可测量单个计算着色器的执行时间
低内存使用率
用于音频处理的媒体基金会,支持大多数音频和视频格式(Ogg Vorbis是个明显的例外),以及在Windows上工作的大多数音频捕获设备(除了一些专业的设备,它们只实现ASIO API)。
语音活动检测用于音频捕获。
该实现基于Mohammad Moattar和Mahdi Homayoonpoor在2009年发表的文章《一种简单而有效的实时语音活动检测算法》。
易于使用COM风格的API,nuget上有成语的C#包装器
预建的二进制文件可用
开发者其他应用
铃声之家铃声制作器
音频处理
1M
1.0
音频转换器TunesKit Audio Converter
音频处理
17.8M
v3.1.0.45 PC版
SAM调音台【整合变声插件】
音频处理
362M
Serato DJ Pro
音频处理
407.5M
v2.2.1 Build 43多语言免费版
Tag Editor
音频处理
18.4M
v3.9.11 开源音乐标签管理工具
adobe audition 2025中文特别优化版
音频处理
584.8M
v24.0.3.3免费版
Steinberg Cubase Elements
音频处理
138.2M
v10.0.30 x64免费版
FxSound Enhancer汉化特别版
音频处理
4.1M
V13.28.0安装版
录音编辑软件SHARM Studio
音频处理
183.1M
v7.12 免费版
Audials One Platinum
音频处理
143.8M
2020.0.53.5300 官方最新版
支持( 0 ) 盖楼(回复)