【Whisper-Webui】一键包 批量离线制作字幕文件 自带large-v3模型
Description
感谢@班班学 的赞助,大家快去关注他~ https://www.123pan.com/s/Pf5Yjv-E5AW3.html 提取码一键三连+关注可见(x 什么?关注了也没有?那你看完简介再说 ==================== 自带large-v3,选择其他模型后会自动下载 ==================== 恭喜你发现了华点 提取码glut 拿了资源就给个免费的赞吧~
感谢@班班学 的赞助,大家快去关注他~ https://www.123pan.com/s/Pf5Yjv-E5AW3.html 提取码一键三连+关注可见(x 什么?关注了也没有?那你看完简介再说 ==================== 自带large-v3,选择其他模型后会自动下载 ==================== 恭喜你发现了华点 提取码glut 拿了资源就给个免费的赞吧~
Comments
不知道为啥,推理时显卡几乎不工作,功耗很低。我用simple模式,largev3,不勾选vad,10个10秒内的音频合计需要90秒才完成文字识别,是不是我的设置有问题,如果能让显卡工作速度应该会很快[思考]
♥ 5 ↩ 6
大佬这是什么问题呀,按照视频教程操作,点击提交之后就报错: error Expecting value: line 1 column 1 (char 0)
♥ 2
whisper-webui更新了吧,V3模型总是跳广告,更新后好像修复了。 “订阅 转发 打赏支持明镜与 点点栏目”这个污染了V2V3大模型的TW媒体,有点膈应。
♥ 2 ↩ 3
请问说话人分离这个报错,这个怎么处理? ValueError: No HuggingFace API Token provided - please use the --auth_token argument or set the HK_ACCESS_TOKEN environment variable
♥ 2 ↩ 3
请问UP,提示“All connection attempts failed”是什么情况?
♥ 1 ↩ 1
v3最低需要多少GB显存啊?
♥ 1
其他还行,就是转化中间加广告就过分了____"请不吝点赞 订阅 转发 打赏支持明镜与点点栏目"
♥ 1 ↩ 1
mac版本的
♥ 1
生成了英文字幕,怎么改中文呀?
♥ 1 ↩ 4
Expecting value: line 1 column 1 (char 0) 什么情况,大佬
♥ 1 ↩ 1
还行,能用,可惜我台式机的50系显卡用不了,我用笔记本的RTX3060试了一下,有时候会生成一些AI幻觉,把一些开头的静音部分识别成了“你不要再說了”(small模型的时候生成了这个)、“由 A■■■■■■.org 社群提供的字幕”(手动码掉,这个是Large-v3时生成出来的)
↩ 1
大佬,你这个整合包支持导入自定义微调的whisper模型吗(不知道可否把自定义的模型添加到模型列表)?我在huggingface上找到几个特化微调过的模型(给出的CER数据要比whisper large v3好),但是作者没说明怎么部署(加上我也是程序小白)。。
↩ 3
RuntimeError: cuBLAS failed with status CUBLAS_STATUS_NOT_SUPPORTED 这个怎么解决啊
↩ 1
已三连+关注
50系无法使用吗
↩ 1
整合包下载解压之后能直接使用吗,还是说要进行一些操作,不知道为什么无法访问
↩ 1
Whisper-Webui】一键包,如何能更新集成v3-turbo啊 质量不差,但速度快8倍啊
大佬你好请教下,如何修改保存文件的盘的位置呢?生成结果貌似一直是在C盘生成的
大佬牛逼