基于Whisper语音识别的实时视频字幕生成 (二): 在线实时字幕

1年前作者：Ephemeroptera分类：Toy博客阅读(15)违法举报

这篇具有很好参考价值的文章主要介绍了基于Whisper语音识别的实时视频字幕生成 (二): 在线实时字幕。希望对大家有所帮助。如果存在错误或未考虑完全的地方，请大家不吝赐教，您也可以点击"举报违法"按钮提交疑问。

Whisream

基于Whisper语音识别的实时视频字幕生成 (二): 在线实时字幕,Whistream,算法设计,工具开发,whisper,opencv,语音识别,人工智能

Whistream（微流）是基于Whisper语音识别的的在线字幕生成工具，支持rtsp/rtmp/mp4等视频流在线语音识别

1. whistream介绍

whistream将在whishow基础上引入whisper进行在线语音识别生成视频字幕

2. 使用

python：

python whistream.py <视频路径>
例1：python whistream.py ./test.mp4
例2：python whistream.py rtmp://mobliestream.c3tv.com:554/live/goodtv.sdp

命令行：

./whistream.exe <视频路径>

在线直播字幕：
基于Whisper语音识别的实时视频字幕生成 (二): 在线实时字幕,Whistream,算法设计,工具开发,whisper,opencv,语音识别,人工智能

3. 联系我们

605686962@qq.com
coolEphemeroptera@gmail.com文章来源地址https://www.toymoban.com/news/detail-849856.html

到了这里，关于基于Whisper语音识别的实时视频字幕生成 (二): 在线实时字幕的文章就介绍完了。如果您还想了解更多内容，请在右上角搜索TOY模板网以前的文章或继续浏览下面的相关文章，希望大家以后多多支持TOY模板网！

本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若转载，请注明出处：如若内容造成侵权/违法违规/事实不符，请点击违法举报进行投诉反馈，一经查实，立即删除！

分享到：

领支付宝红包赞助服务器费用

基于whisper模型的在线添加视频字幕网站（持续更新）
Whisper 是一个自动语音识别（ASR，Automatic Speech Recognition）系统，OpenAI 通过从网络上收集了 68 万小时的多语言（98 种语言）和多任务（multitask）监督数据对 Whisper 进行了训练。OpenAI 认为使用这样一个庞大而多样的数据集，可以提高对口音、背景噪音和技术术语的识别能力。除
2024年02月03日
浏览(26)
英文视频添加中英双语字幕（基于Whisper语音识别和Google翻译）
可以参考以下博客的内容讲显卡驱动，CUDA和cudnn的安装比较详细，我建议能用GPU加速就尽量使用，Whisper速度有点慢如何在你的电脑上完成whisper的简单部署_Wayne_WX的博客-CSDN博客 Windows使用whisper前需要进行的一些环境配置 https://blog.csdn.net/m0_52156129/article/details/129263703 我的f
2024年02月09日
浏览(13)
《AI上字幕》基于openAI研发的whisper模型，语音（视频）一键转文本/字幕/带时间轴/支持多语言/自带翻译《桌面版教程》
OpenAI的chatGPT非常火爆，其实OpenAI旗下的另一个模型实力也十分强大，它就是开源免费的Whisper语音转文本模型，目前为止它是较为顶尖的语音转文本模型当前github上也有许多出色的开发者根据此模型开发出桌面版语音转文字应用。较为出色的分别是Buzz和WhisperDesktop 支持将多种
2023年04月19日
浏览(12)
【开源工具】使用Whisper提取视频、语音的字幕
运行 WhisperDesktop.exe , 启动后加载模型“load model，please wait…”,等待其将模型加载到内存。 2.1 下载模型刚开始是没有模型的，需要到Hugging Face 2 的仓库里面下载模型并配置相关路径 2.1.1 进入Hugging Face 2 的仓库点击 ggerganov/whisper.cpp 进入Hugging Face仓库 2.1.2 选择需要下载的模型
2024年02月09日
浏览(37)
【开源工具】使用Whisper将提取视频、语音的字幕
运行 WhisperDesktop.exe , 启动后加载模型“load model，please wait…”,等待其将模型加载到内存。 2.1 下载模型刚开始是没有模型的，需要到Hugging Face 2 的仓库里面下载模型并配置相关路径 2.1.1 进入Hugging Face 2 的仓库点击 ggerganov/whisper.cpp 进入Hugging Face仓库 2.1.2 选择需要下载的模型
2024年02月08日
浏览(39)
极速进化,光速转录,C++版本人工智能实时语音转文字(字幕/语音识别)Whisper.cpp实践
业界良心OpenAI开源的Whisper模型是开源语音转文字领域的执牛耳者，白璧微瑕之处在于无法通过苹果M芯片优化转录效率，Whisper.cpp 则是 Whisper 模型的 C/C++ 移植版本，它具有无依赖项、内存使用量低等特点，重要的是增加了 Core ML 支持，完美适配苹果M系列芯片。 Whisper.cpp的张量
2024年02月02日
浏览(15)
如何一键生成字幕，如何快速处理生肉资源？借助whisper语音识别系统生成.srt字幕文件手把手教学在Windows、CPU版本下whisper的安装与使用，快速上手！
Whisper是Open AI开源的语音识别网络，支持98中语言，用于语音识别和翻译等任务。我们可以将歌曲的歌词进行识别，将无字幕的视频资源自动生成字母，极大方便了用户。同时，whisper可以在本地运行，充分保障了个人隐私。在识别方面也具有较准确的识别能力。因此想通过本
2024年02月02日
浏览(25)
不到百行代码，使用Whisper进行视频字幕生成。
最近在学习视频剪辑的时候，希望找一款软件进行翻译；发现大多数是调用某云的Api进行翻译。通过查询资料,打算使用Whisper进行本地视频语音的识别，然后进行字幕文件的编辑（srt），最后通过ffmpeg添加到视频中。 Whisper 是 OpenAI 构建的通用语音识别模型。它于 2
2024年03月19日
浏览(10)
github开源推荐，基于whisper的字幕生成和字幕翻译工具——再也没有看不懂的片啦
GitHub - qinL-cdy/auto_ai_subtitle github上开源的一款字幕生成和字幕翻译的整合工具，可以根据视频中提取到的音频来转换成字幕，再根据需要将字幕进行翻译，基于whisper 1）安装ffmpeg 安装ffmpeg的教程比较多，就不详细介绍了，Windows上安装完成后记得添加环境变量，最后在cmd中输入
2024年02月13日
浏览(23)
[python]基于faster whisper实时语音识别语音转文本
语音识别转文本相信很多人都用过，不管是手机自带，还是腾讯视频都附带有此功能，今天简单说下： faster whisper地址： https://github.com/SYSTRAN/faster-whisper https://link.zhihu.com/?target=https%3A//github.com/SYSTRAN/faster-whisper 实现功能：从麦克风获取声音进行实时语音识别转文本代码仅仅
2024年02月03日
浏览(10)