haoone - 更新日志 | haoai更新日志
haoone
最新版本: v11.4.3共 50 个版本
发布时间: 2026年7月30日文件大小: 52.2 MB
•自定义 API 增加模型选择框,可以自动填入 API url
•优化说话人修改界面,区分单次修改与批量修改
•导出时自动同步双语配置
•修正数字英文之间多余的空格
•修正中文数字转化的一个问题
•===============================
•修正多语言下的导出说话人,无法选中说话人问题
•修正字幕输入框不支持 cmd+x 的问题
•字幕输入框适配长英文
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•导出可以导出指定说话人 srt 内容
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•优化导出弹层样式
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•修正切换文件后字幕内容没有切换的问题
•修正合并字幕操作后,字幕被异常修改的 bug
•二次转录清理掉多语言版本
•合并上一行 下一行 自动加一个空格
•===============================
•新的翻译操作,整合双语与翻译
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•通过勾选语言的选择来控制展示顺序
•去掉双语配置,双语整合到翻译
•支持同时显示二种以上的语言字幕
•批量翻译支持新的翻译多语言模式
•文稿视图支持多语言内容
•导出支持新的翻译模式
•远程转录增加局部转录支持
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
换行,而不是不拆分字幕段
•修正部分长音频音频波形会消失的问题
•修正批量翻译不会显示进度条的问题
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•有了局部转录后,长音频可以实现分段转录的效果
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•修正口语短句被误拆分的问题
•修正英语专有名词有空格的 bug
•修正英语数字 bug
•修正字幕重叠的异常 case
•修正 vad 被强制截断的问题
•修正自动贴合设置开关无效的 bug
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•修正英语转录时候时间线滚动错误的问题
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•修正部分视频音频波形只显示一半的问题
•去掉自动的短句合并逻辑,避免影响说话人判断
•重构说话人分割的逻辑,提升说话人的对应性
•说话人数量可以自动识别
•增加说话人识别模型选择
•去掉说话人分割模型
•"自动贴合字幕" 不再设置阈值,默认开启
•haoone-client 命令行工具增加说话人识别命令
•修正章节总结视图中说话人显示错误问题
•优化导出的说话人名称
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新增不同说话人分割
•新增说话人设置
•导出字幕文件支持带说话人信息导出
•新增声纹库,可以注册说话人
•支持说话人过滤字幕
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•默认视图改成句子视图,支持视图切换
•二个字幕编辑视图支持说话人
•清理掉 end=start 的异常字幕句子
•新的文稿视图,不依赖 AI 章节生成
•新增标点恢复
•中文数字增加统一的约数转化处理
•修复因为数据库扩容导致的模型下载验证失败问题
v11.4.2
发布时间: 2026年7月28日文件大小: 52.0 MB
•修正多语言下的导出说话人,无法选中说话人问题
•修正字幕输入框不支持 cmd+x 的问题
•字幕输入框适配长英文
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•导出可以导出指定说话人 srt 内容
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•优化导出弹层样式
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•修正切换文件后字幕内容没有切换的问题
•修正合并字幕操作后,字幕被异常修改的 bug
•二次转录清理掉多语言版本
•合并上一行 下一行 自动加一个空格
•===============================
•新的翻译操作,整合双语与翻译
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•通过勾选语言的选择来控制展示顺序
•去掉双语配置,双语整合到翻译
•
v11.4.1
发布时间: 2026年7月28日文件大小: 52.0 MB
•导出可以导出指定说话人 srt 内容
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•优化导出弹层样式
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•修正切换文件后字幕内容没有切换的问题
•修正合并字幕操作后,字幕被异常修改的 bug
•二次转录清理掉多语言版本
•合并上一行 下一行 自动加一个空格
•===============================
•新的翻译操作,整合双语与翻译
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•通过勾选语言的选择来控制展示顺序
•去掉双语配置,双语整合到翻译
•支持同时显示二种以上的语言字幕
•批量翻译支持新的翻译多语言模式
•文稿视图支持多语言内容
•导出支持新的翻译模式
•远程转录增加局部转录支持
•haoone-client 命令行工具增加局部转录支持
v11.4.0
发布时间: 2026年7月27日文件大小: 52.0 MB
•新的翻译操作,整合双语与翻译
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•通过勾选语言的选择来控制展示顺序
•去掉双语配置,双语整合到翻译
•支持同时显示二种以上的语言字幕
•批量翻译支持新的翻译多语言模式
•文稿视图支持多语言内容
•导出支持新的翻译模式
•远程转录增加局部转录支持
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
换行,而不是不拆分字幕段
•修正部分长音频音频波形会消失的问题
•修正批量翻译不会显示进度条的问题
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•有了局部转录后,长音频可以实现分段转录的效果
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
v11.3.0
发布时间: 2026年7月25日文件大小: 52.0 MB
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•有了局部转录后,长音频可以实现分段转录的效果
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•修正口语短句被误拆分的问题
•修正英语专有名词有空格的 bug
•修正英语数字 bug
•修正字幕重叠的异常 case
•修正 vad 被强制截断的问题
•修正自动贴合设置开关无效的 bug
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•修正英语转录时候时间线滚动错误的问题
v11.2.0
发布时间: 2026年7月23日文件大小: 52.0 MB
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•修正英语转录时候时间线滚动错误的问题
•===============================
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•感谢小伙伴认可,用软件的小伙伴越来越多,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•修正部分视频音频波形只显示一半的问题
•去掉自动的短句合并逻辑,避免影响说话人判断
•重构说话人分割的逻辑,提升说话人的对应性
•说话人数量可以自动识别
•增加说话人识别模型选择
•去掉说话人分割模型
v11.1.0
发布时间: 2026年7月20日文件大小: 52.0 MB
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•感谢小伙伴认可,用软件的小伙伴越来越多,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•修正部分视频音频波形只显示一半的问题
•去掉自动的短句合并逻辑,避免影响说话人判断
•重构说话人分割的逻辑,提升说话人的对应性
•说话人数量可以自动识别
•增加说话人识别模型选择
•去掉说话人分割模型
•"自动贴合字幕" 不再设置阈值,默认开启
•haoone-client 命令行工具增加说话人识别命令
•修正章节总结视图中说话人显示错误问题
•优化导出的说话人名称
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新增不同说话人分割
•新增说话人设置
v11.0.0
发布时间: 2026年7月16日文件大小: 51.2 MB
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新增不同说话人分割
•新增说话人设置
•导出字幕文件支持带说话人信息导出
•新增声纹库,可以注册说话人
•支持说话人过滤字幕
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•默认视图改成句子视图,支持视图切换
•二个字幕编辑视图支持说话人
•清理掉 end=start 的异常字幕句子
•新的文稿视图,不依赖 AI 章节生成
•新增标点恢复
•中文数字增加统一的约数转化处理
•修复因为数据库扩容导致的模型下载验证失败问题
v10.15.2
发布时间: 2026年7月15日文件大小: 50.5 MB
•优化转录引擎,优化 qwen3-asr 部分长音频转录时出现重复单词幻觉问题
•日语转录优化漏词问题
•日语转录优化日语歌曲的词语级对齐
•===============================
•语气词清理增加:是吧、好吧、对吧、行吧、可以吧、不是吧、是不是、对不对 等处理
•兼容Windows status=exit code: Oxc0000005, code=-1073741819 转录异常,提示用户需要重装 Microsoft Visual C++ 2015-2022
•时间线增加滚动条
•多声道自动合并成单声道
•显著提升视频文件导入速度
•针对长音频,导入文件增加进度条显示
•中文数字格式化增加X 分之 X 的支持
•中文数字转化优化,修正几个转化的 bad case
•增加负数的自动转化
•===============================
•重新实现转录命令与主进程的主子隔离重构,防止转录中异常导致程序也一并崩溃的问题
•提升 firered_vad 执行时的稳定性
•更清晰捕获转录失败时的错误
•隐藏 Windows 11 的执行窗口
•===============================
v10.15.1
发布时间: 2026年7月12日文件大小: 49.9 MB
•语气词清理增加:是吧、好吧、对吧、行吧、可以吧、不是吧、是不是、对不对 等处理
•兼容Windows status=exit code: Oxc0000005, code=-1073741819 转录异常,提示用户需要重装 Microsoft Visual C++ 2015-2022
•时间线增加滚动条
•多声道自动合并成单声道
•显著提升视频文件导入速度
•针对长音频,导入文件增加进度条显示
•中文数字格式化增加X 分之 X 的支持
•中文数字转化优化,修正几个转化的 bad case
•增加负数的自动转化
•===============================
•重新实现转录命令与主进程的主子隔离重构,防止转录中异常导致程序也一并崩溃的问题
•提升 firered_vad 执行时的稳定性
•更清晰捕获转录失败时的错误
•隐藏 Windows 11 的执行窗口
•===============================
•修正 mac 下下载模型报错的问题
•修正 haoone-client 热词替换不生效的问题
•===============================
•全面增强热词替换能力,解决 qwen3-asr 专有名词不准的问题
v10.15.0
发布时间: 2026年7月9日文件大小: 49.9 MB
•重新实现转录命令与主进程的主子隔离重构,防止转录中异常导致程序也一并崩溃的问题
•提升 firered_vad 执行时的稳定性
•更清晰捕获转录失败时的错误
•隐藏 Windows 11 的执行窗口
•===============================
•修正 mac 下下载模型报错的问题
•修正 haoone-client 热词替换不生效的问题
•===============================
•全面增强热词替换能力,解决 qwen3-asr 专有名词不准的问题
•热词替换是双重替换:1 转录引擎会将热词传给模型context,做第一重替换;2 命中错字、拼音做第二重 AI 替换
•热词设置时,错词可以为空
•修正部分场景热词无法添加的问题
•===============================
•修正翻译提示词修改保存后不生效的 bug
•修正翻译与校正自定义端点不生效的问题
•视频导入增加 mkv、avi 格式支持,但是不支持这二种格式的解码,暂时看不到画面
•修正本地 ollama 无法获取到端点的模型列表的 bug
•优化日语拆行避免太碎
•===============================
v10.14.1
发布时间: 2026年7月7日文件大小: 49.7 MB
•修正 mac 下下载模型报错的问题
•修正 haoone-client 热词替换不生效的问题
•===============================
•全面增强热词替换能力,解决 qwen3-asr 专有名词不准的问题
•热词替换是双重替换:1 转录引擎会将热词传给模型context,做第一重替换;2 命中错字、拼音做第二重 AI 替换
•热词设置时,错词可以为空
•修正部分场景热词无法添加的问题
•===============================
•修正翻译提示词修改保存后不生效的 bug
•修正翻译与校正自定义端点不生效的问题
•视频导入增加 mkv、avi 格式支持,但是不支持这二种格式的解码,暂时看不到画面
•修正本地 ollama 无法获取到端点的模型列表的 bug
•优化日语拆行避免太碎
•===============================
•修正 Windows 下同时有集成显卡与独立显卡时,程序会跑在集成显卡的问题
•修正Windows 下如果模型放在中文目录,会报模型执行异常的问题
•Windows 不要把模型放在中文文件夹,不要把模型放在中文文件夹,不要把模型放在中文文件夹
•修正Windows目录中删除模型,但界面中还是显示模型未删除的问题
v10.14.0
发布时间: 2026年7月5日文件大小: 49.7 MB
•全面增强热词替换能力,解决 qwen3-asr 专有名词不准的问题
•热词替换是双重替换:1 转录引擎会将热词传给模型context,做第一重替换;2 命中错字、拼音做第二重 AI 替换
•热词设置时,错词可以为空
•修正部分场景热词无法添加的问题
•===============================
•修正翻译提示词修改保存后不生效的 bug
•修正翻译与校正自定义端点不生效的问题
•视频导入增加 mkv、avi 格式支持,但是不支持这二种格式的解码,暂时看不到画面
•修正本地 ollama 无法获取到端点的模型列表的 bug
•优化日语拆行避免太碎
•===============================
•修正 Windows 下同时有集成显卡与独立显卡时,程序会跑在集成显卡的问题
•修正Windows 下如果模型放在中文目录,会报模型执行异常的问题
•Windows 不要把模型放在中文文件夹,不要把模型放在中文文件夹,不要把模型放在中文文件夹
•修正Windows目录中删除模型,但界面中还是显示模型未删除的问题
•修正Windows 下部分场景下载模型不完整的问题
•修正日语模型运行降级成 CPU 运行的问题
•===============================
v10.13.4
发布时间: 2026年7月4日文件大小: 49.1 MB
•修正翻译提示词修改保存后不生效的 bug
•修正翻译与校正自定义端点不生效的问题
•视频导入增加 mkv、avi 格式支持,但是不支持这二种格式的解码,暂时看不到画面
•修正本地 ollama 无法获取到端点的模型列表的 bug
•优化日语拆行避免太碎
•===============================
•修正 Windows 下同时有集成显卡与独立显卡时,程序会跑在集成显卡的问题
•修正Windows 下如果模型放在中文目录,会报模型执行异常的问题
•Windows 不要把模型放在中文文件夹,不要把模型放在中文文件夹,不要把模型放在中文文件夹
•修正Windows目录中删除模型,但界面中还是显示模型未删除的问题
•修正Windows 下部分场景下载模型不完整的问题
•修正日语模型运行降级成 CPU 运行的问题
•===============================
•提升配置低的 windows 转录的稳定性
•转录报错增加更清晰的错误提示
•修正 mac 的mimo-V2.5-ASR 转录的一个小 bug
•转录引擎修正 parakeet-tdt-0.6b-ja 日语模型的 漏句、漏词问题
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•
v10.13.3
发布时间: 2026年7月2日文件大小: 49.1 MB
•修正 Windows 下同时有集成显卡与独立显卡时,程序会跑在集成显卡的问题
•修正Windows 下如果模型放在中文目录,会报模型执行异常的问题
•Windows 不要把模型放在中文文件夹,不要把模型放在中文文件夹,不要把模型放在中文文件夹
•修正Windows目录中删除模型,但界面中还是显示模型未删除的问题
•修正Windows 下部分场景下载模型不完整的问题
•修正日语模型运行降级成 CPU 运行的问题
•===============================
•提升配置低的 windows 转录的稳定性
•转录报错增加更清晰的错误提示
•修正 mac 的mimo-V2.5-ASR 转录的一个小 bug
•转录引擎修正 parakeet-tdt-0.6b-ja 日语模型的 漏句、漏词问题
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•全面优化日语模型的转录速度,不再依赖qwen3补录,预计提速 20%,30显卡就可以转录
•重构日语的断句算法,长句拆分更合理
•修正远程转录长音频的日语会报错的问题
•修正Windows 下 GPU 降级失败的问题
•下载日语模型时自动下载日语对齐模型
•实现日语歌曲的对齐
•
v10.13.2
发布时间: 2026年7月1日文件大小: 49.1 MB
•提升配置低的 windows 转录的稳定性
•转录报错增加更清晰的错误提示
•修正 mac 的mimo-V2.5-ASR 转录的一个小 bug
•转录引擎修正 parakeet-tdt-0.6b-ja 日语模型的 漏句、漏词问题
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•全面优化日语模型的转录速度,不再依赖qwen3补录,预计提速 20%,30显卡就可以转录
•重构日语的断句算法,长句拆分更合理
•修正远程转录长音频的日语会报错的问题
•修正Windows 下 GPU 降级失败的问题
•下载日语模型时自动下载日语对齐模型
•实现日语歌曲的对齐
•===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
v10.13.0
发布时间: 2026年6月29日文件大小: 48.9 MB
•新增 日语-v2-2026 模型,使用 reazonspeech-nemo-v2 模型代替 parakeet-tdt-0.6b-ja
•新模型在漏句、漏词、短句、日语歌曲识别上好于 parakeet-tdt-0.6b-ja
•新模型的日语识别准确率在 95% 左右,
•转录引擎增加 日语-v2-2026 模型 的支持,并完成模型调用的调优
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•全面优化日语模型的转录速度,预计提速 30%,转录速度极快,30显卡就可以转录
•重构日语的断句算法,长句拆分更合理
•===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•
v10.12.1
发布时间: 2026年6月25日文件大小: 48.9 MB
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
*
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
v10.12.0
发布时间: 2026年6月24日文件大小: 48.9 MB
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
*
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•
v10.11.7
发布时间: 2026年6月23日文件大小: 48.9 MB
•Windows 下执行转录报:执行模型异常,是模型目录权限问题,务必自定义下模型存放位置
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正对齐小段落切分音频时异常报错的问题
•修正性能不好的电脑,长音频对齐会卡进度的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•修正搜索时字幕误跳转的 bug
•优化日语英语的语气词删除
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•
v10.11.6
发布时间: 2026年6月21日文件大小: 48.8 MB
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正对齐小段落切分音频时异常报错的问题
•修正性能不好的电脑,长音频对齐会卡进度的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
v10.11.5
发布时间: 2026年6月18日文件大小: 48.8 MB
•修正搜索时字幕误跳转的 bug
•优化日语英语的语气词删除
•记忆用户字幕所在位置,下次打开程序,回到该位置
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•修正字幕边框设置为 0 不生效的问题
•修正字幕设置显示不全的问题
v10.11.4
发布时间: 2026年6月15日文件大小: 49.1 MB
•优化中文拆行,让拆行更符合语义
•用户可以自定义拆行的提示词
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•达芬奇插件 PR插件 下线老模型
•优化 达芬奇插件 PR插件 的AI 拆行
•达芬奇插件下线
•修正最后一行是语气词时清理异常的情况
v10.11.2
发布时间: 2026年6月14日文件大小: 49.1 MB
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•重构双语字幕的逻辑,优化双语字幕不稳定的情况
•短句合并增加句子的播放功能,增加自动添加空格的功能
•AI 纠错增加句子的播放功能,方便用户确认
•修正日语 AI 拆行破坏语义的问题
•统一批量双语、翻译与单文件处理的逻辑
v10.11.1
发布时间: 2026年6月11日文件大小: 49.1 MB
•适配小屏幕模型下载内容信息显示不全的问题
•haoone-cli 转录兼容无片段的报错
•兼容达芬奇插件的异常
•haoone-cli 支持 mimo-v2.5-asr
v10.11.0
发布时间: 2026年6月10日文件大小: 49.1 MB
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•彻底下线老的转录引擎
•减小 20% 程序体积
•修正小屏幕的电脑,操作按钮文案换行的问题
•修正文稿匹配的高度错误
v10.10.0
发布时间: 2026年6月9日文件大小: 68.0 MB
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•转录速度: 日语-2026 > 英语-日语-2026 > 多语种-增强-2026
•准确性:英语-日语-2026 > 日语-2026 > 多语种-增强-2026
•番剧识别:日语-2026 > 英语-日语-2026 > 多语种-增强-2026
•英日混合、多人:英语-日语-2026 > 日语-2026 > 多语种-增强-2026
•强噪场景:多语种-增强-2026 > 日语-2026 > 英语-日语-2026
•修正项目名无法复制、粘贴的问题
•优化对齐词表
v10.9.2
发布时间: 2026年6月8日文件大小: 68.0 MB
•优化纠错逻辑,提升纠错的准确性
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•优化提示词管理
•修正达芬奇插件不会记忆用户的选项的问题
•修正中英边界的拆行异常
•修正中文单位转换时的部分异常
•===============================
•修正章节总结 AI 会改内容的问题
•修正非激活用户 AI 拆行报错的问题
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•翻译后清理掉句子结尾的标点
•自定义 LLM API 端点,url 会自动补全
v10.9.1
发布时间: 2026年6月6日文件大小: 68.0 MB
•修正章节总结 AI 会改内容的问题
•修正非激活用户 AI 拆行报错的问题
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•翻译后清理掉句子结尾的标点
•自定义 LLM API 端点,url 会自动补全
v10.9.0
发布时间: 2026年6月5日文件大小: 68.0 MB
•AI 调用使用充值金额消耗模式,AI 调用模型与价格透明化,就直接使用公认的百万 token 计费的方式
•为了后面可以配置最好的国外模型 API
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•修正远程转录日语时出来中文的问题
v10.8.0
发布时间: 2026年6月4日文件大小: 67.9 MB
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•有英语转录需求的小伙伴优先使用新模型
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•下线老的对齐模型
v10.7.1
发布时间: 2026年6月3日文件大小: 67.9 MB
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•修正翻译与双语会500 错误的问题
v10.7.0
发布时间: 2026年6月2日文件大小: 67.9 MB
•增加 AI 生成章节能力
•文稿视图升级为章节视图,可以显示章节与文字稿
•修正导出文件名无法复制的问题
•翻译增加自定义提示词
•双语翻译增加自定义提示词
•统一管理提示词
•提示词支持重置,不同语言支持配置不同的提示词
•增加短句合并功能
•修正模型下载没有下载新的对齐模型的问题
•修正长音频翻译时会漏翻的问题
•修正英文序号数字转化问题
v10.6.0
发布时间: 2026年6月1日文件大小: 67.9 MB
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•整体转录时间英文提升 30%,中文提升 15%
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
v10.4.7
发布时间: 2026年5月31日文件大小: 68.5 MB
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•修正部分日语断句会破坏语义的问题
•修正 AI 拆行的语言判断问题
v10.4.6
发布时间: 2026年5月30日文件大小: 68.5 MB
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正日语拆行长句时,会出现长句重叠短句的情况
•修正日语中英文会有空格的问题
•修正日语中英语字母有空格的问题
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正远程转录部分任务异常的 bug
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•修正部分场景 AI 拆行不生效的问题
•选中日语模型,自动选中日语
v10.4.5
发布时间: 2026年5月29日文件大小: 68.5 MB
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•优化日语歌曲的识别
•文稿匹配增加日语的支持
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•优化日语、英语的 AI 拆行规则
•优化模型检测错误提示
v10.4.3
发布时间: 2026年5月28日文件大小: 68.5 MB
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•优化日语、英语的 AI 拆行规则
•优化模型检测错误提示
v10.4.2
发布时间: 2026年5月27日文件大小: 68.5 MB
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•优化 AI 纠错默认提示词
•修正合成字体 Windows 下中文字体显示乱码问题
•网盘添加日语专用模型下载
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
•修正不会自动下载对齐模型的 bug
v10.4.0
发布时间: 2026年5月26日文件大小: 68.5 MB
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•增加日语的语气词的自动清理
•增加 AAC 音频格式的支持
*
•===============================
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
v10.3.3
发布时间: 2026年5月24日文件大小: 68.4 MB
•修正对齐模型下载会报错的问题
•修正中文百分比没有转化的 bug
•修正中文顿号导致拆分异常的 bug
•优化对齐算法性能约 5%
v10.3.2
发布时间: 2026年5月23日文件大小: 68.5 MB
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•===============================
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•修正日语专用模型部分时间戳没有对齐的问题
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正 AI 英文专有名称修正无效的问题
•修正用户转录、双语的设置不会自动记忆的问题
*
•===============================
•10.x.x 版本更新汇总:
•
v10.3.0
发布时间: 2026年5月21日文件大小: 68.4 MB
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•===============================
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度快,对电脑要求低,准确率 92%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•词语级对齐算法适配日语,实现 98% 的对齐精度
•修正转录日语会报错的问题
•修正日中双语字幕会失败的问题
•修正英语双语字幕会出现二个都是英语的问题
•修正部分情况英语转录卡 95% 进度的问题
*
•===============================
•10.x.x 版本更新汇总:
v10.2.0
发布时间: 2026年5月15日文件大小: 68.4 MB
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•优化 AI 校正链路的稳定性
*
•===============================
•10.x.x 版本更新汇总:
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
v10.1.2
发布时间: 2026年5月14日文件大小: 68.5 MB
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•修正达芬奇插件远程转录时的出现英文字符的 bug
*
•===============================
•10.x.x 版本更新汇总:
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•
v10.1.1
发布时间: 2026年5月13日文件大小: 67.2 MB
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
*
•===============================
•10.x.x 版本更新汇总:
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•
v10.1.0
发布时间: 2026年5月11日文件大小: 67.2 MB
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•使用举例:在claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•修正部分场景智能拆行不生效 bug
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•优化 AI 拆行
•API 端点支持本地大模型 server(不需要填入 key)
•修正短句合并后没有空格的问题
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
*
v10.0.3
发布时间: 2026年5月7日文件大小: 51.9 MB
•导入视频支持 webm 格式
•修正参数会被识别成 3 数的问题
•修复百分比转换成数字错误的问题
•修正部分英文与中文之间缺少空格的问题
•PR 插件增加多语种-增强-2026 模型
•修正部分 windows 看不到 PR 插件的问题
*
•===============================
•10.x.x 版本更新汇总:
•haoone client 与 skill 上线,小规模内测中,预计 5 月中开放使用
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•统一字幕后处理的流程
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
v10.0.2
发布时间: 2026年5月5日文件大小: 51.9 MB
•10.0.x 大版本内测中,如果你遇到使用中的异常情况,可以使用9.9.x版本
•可以在 https://www.haoai.pro/feedback/haoone 反馈 10.x.x的问题
•haoone client 与 skill 上线,小规模内测中,预计 5 月中开放使用
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•统一字幕后处理的流程
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•去掉老的转录引擎查找.bin模型文件的逻辑
•支持 m4a 格式文件的导入
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
v10.0.1
发布时间: 2026年5月4日文件大小: 51.9 MB
•10.0.x 大版本内测中,如果你遇到使用中的异常情况,可以使用9.9.x版本
•可以在 https://www.haoai.pro/feedback/haoone 反馈 10.x.x的问题
•haoone client 与 skill 上线,小规模内测中,预计 5 月中开放使用
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•统一字幕后处理的流程
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•去掉老的转录引擎查找.bin模型文件的逻辑
支持同时显示二种以上的语言字幕
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
导出字幕文件支持带说话人信息导出
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•修正 haoone-client 热词替换不生效的问题
•===============================
•全面增强热词替换能力,解决 qwen3-asr 专有名词不准的问题
•热词替换是双重替换:1 转录引擎会将热词传给模型context,做第一重替换;2 命中错字、拼音做第二重 AI 替换
•===============================
•视频导入增加 mkv、avi 格式支持,但是不支持这二种格式的解码,暂时看不到画面
•修正本地 ollama 无法获取到端点的模型列表的 bug
•===============================
•修正 Windows 下同时有集成显卡与独立显卡时,程序会跑在集成显卡的问题
•修正Windows 下如果模型放在中文目录,会报模型执行异常的问题
•Windows 不要把模型放在中文文件夹,不要把模型放在中文文件夹,不要把模型放在中文文件夹
•修正Windows目录中删除模型,但界面中还是显示模型未删除的问题
•修正Windows 下部分场景下载模型不完整的问题
•===============================
•修正 mac 的mimo-V2.5-ASR 转录的一个小 bug
•转录引擎修正 parakeet-tdt-0.6b-ja 日语模型的 漏句、漏词问题
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•全面优化日语模型的转录速度,不再依赖qwen3补录,预计提速 20%,30显卡就可以转录
•===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
•热词替换是双重替换:1 转录引擎会将热词传给模型context,做第一重替换;2 命中错字、拼音做第二重 AI 替换
•===============================
•视频导入增加 mkv、avi 格式支持,但是不支持这二种格式的解码,暂时看不到画面
•修正本地 ollama 无法获取到端点的模型列表的 bug
•===============================
•修正 Windows 下同时有集成显卡与独立显卡时,程序会跑在集成显卡的问题
•修正Windows 下如果模型放在中文目录,会报模型执行异常的问题
•Windows 不要把模型放在中文文件夹,不要把模型放在中文文件夹,不要把模型放在中文文件夹
•修正Windows目录中删除模型,但界面中还是显示模型未删除的问题
•修正Windows 下部分场景下载模型不完整的问题
•===============================
•修正 mac 的mimo-V2.5-ASR 转录的一个小 bug
•转录引擎修正 parakeet-tdt-0.6b-ja 日语模型的 漏句、漏词问题
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•全面优化日语模型的转录速度,不再依赖qwen3补录,预计提速 20%,30显卡就可以转录
•===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
•修正 Windows 下同时有集成显卡与独立显卡时,程序会跑在集成显卡的问题
•修正Windows 下如果模型放在中文目录,会报模型执行异常的问题
•Windows 不要把模型放在中文文件夹,不要把模型放在中文文件夹,不要把模型放在中文文件夹
•修正Windows目录中删除模型,但界面中还是显示模型未删除的问题
•修正Windows 下部分场景下载模型不完整的问题
•===============================
•修正 mac 的mimo-V2.5-ASR 转录的一个小 bug
•转录引擎修正 parakeet-tdt-0.6b-ja 日语模型的 漏句、漏词问题
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•全面优化日语模型的转录速度,不再依赖qwen3补录,预计提速 20%,30显卡就可以转录
•===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
•
修正Windows 下部分场景下载模型不完整的问题
•===============================
•修正 mac 的mimo-V2.5-ASR 转录的一个小 bug
•转录引擎修正 parakeet-tdt-0.6b-ja 日语模型的 漏句、漏词问题
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•全面优化日语模型的转录速度,不再依赖qwen3补录,预计提速 20%,30显卡就可以转录
•===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
•
提升配置低的 windows 转录的稳定性
•修正 mac 的mimo-V2.5-ASR 转录的一个小 bug
•转录引擎修正 parakeet-tdt-0.6b-ja 日语模型的 漏句、漏词问题
•不使用模型自带的时间戳,不是很准,使用自实现的日语对齐算法
•全面优化日语模型的转录速度,不再依赖qwen3补录,预计提速 20%,30显卡就可以转录
•===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
全面优化日语模型的转录速度,不再依赖qwen3补录,预计提速 20%,30显卡就可以转录
•===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
===============================
•修正显存小的 Windows 电脑,报对齐 session 建立错误的 bug
•Windows 下支持开启 GPU 加速开关,可以降级为 CPU 转录
•更及时释放显存,提升 Windows 转录的稳定性
•===============================
•mac 本地转录增加 MiMo-V2.5-ASR Q4 量化版本,性能与稳定性优化完毕,电脑配置最低要求:M2-16G内存
•Windows 目前无法集成 MiMo-V2.5-ASR,有技术难点还需攻克
•mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
•
mac 优化c++/rust转录引擎修正运行 MiMo-V2.5-ASR 时降级到 CPU,导致运行慢的问题
•转录耗时预估做个参考:1 分钟视频,mac 42 秒
•MiMo-V2.5-ASR 是方言转录第一首选,特别是粤语
•修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
修复Windows的用户名如果是中文,达芬奇插件执行转录会报错的问题
•修正部分 Windows 电脑报:执行模型异常 的 bug
•===============================
•修正转录引擎 c++ 在处理 parakeet-tdt-0.6b-ja 日语模型的编码器音频读取 bug,导致会漏句的问题
•parakeet在转录日语长句时会漏句,增加长句使用多语言-增强-2026补录的逻辑,所以多语言-增强-2026模型是必装的
•如果你的日语语音质量一般,建议使用多语言-增强-2026,多语言-增强-2026转录日语时幻觉与断句不够好。
•推荐使用日语专用模型+安装上语言-增强-2026、日语对齐模型的组合,混合模式程序会自动执行
•进一步优化日语的对齐模型算法,提升多语言-增强-2026 在转录日语时的可用性
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
•重新上线 parakeet-tdt-0.6b-ja 日语专用模型
•===============================
•优化c++并发调用对齐模型与 rust 执行的逻辑,防止 mac 下 CTC 对齐长音频时内存溢出,程序崩溃的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
修正对齐小段落切分音频时异常报错的问题
•修正文稿匹配后段落的 end 值被改变的 bug
•修正对齐 清理后的文本为空 报错,中断转录流程的问题
•===============================
•记忆用户字幕所在位置,下次打开程序,回到该位置git
•适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
适配分辨率高度不够的笔记本,修复按钮不会显示的问题
•适配分辨率宽度不够的笔记本,修复字幕设置显示不全的问题,优化部分视图
•===============================
•达芬奇插件远程转录增加 mimo V2.5 ASR模型
•PR插件远程转录增加 mimo V2.5 ASR模型
•修正打开应用程序后,达芬奇插件 PR插件 的配置被误初始化,变成无法记忆用户的转录配置问题
•===============================
•优化对齐任务时防止长音频内存占用,防止部分mac电脑崩溃
•短句合并增加句子的播放功能,增加自动添加空格的功能
•===============================
•haoone-cli 支持 mimo-v2.5-asr
•===============================
•远程转录增加中文识别准确率最高的模型:mimo-v2.5-asr
•市面上最便宜的远程调用服务:1 小时仅需 0.5 元
•最准的方言识别能力、专有名词识别能力,中英准确率吊打剪映,对标 elevenlabs
•详细可以到浩叔的 B 站看汉语识别 ASR 模型测评
•haoone 软件针对mimo-v2.5-asr做了优化与适配,支持词语级的时间戳,长音频转录,断句优化,数字表达优化等...
•彻底下线老的对齐模型与算法代码,软件不再依赖 N 卡驱动,A 卡、核显也能运行
•===============================
•增加日语专用对齐模型,显著提升非日语专用模型的对齐精度
•新增 英语-日语-2026 模型,增加日语支持,在日英混合、youtube 视频转录上识别更准
•===============================
•纠错模型升级成最新 qwen3.7-plus ,经过验证,拥有更好的纠错效果
•===============================
•修正 AI 拆行与 AI 热词替换没有返回输出 tokens 与输入 tokens 的问题
•自定义 LLM API 端点,url 会自动补全
•===============================
•AI 调用使用充值金额消耗模式,价格跟大模型平台官网价格保持一致,避免调用次数的换算,降低用户的认知门槛
•大模型按 token 消耗扣费,语音识别模型按照音频时长扣费
•不会影响老用户的调用次数权益,调用次数计算方式不变
•===============================
•增加英语专用模型,英语识别准确率97%,执行速度是 qwen3-asr-1.7B的 2 倍,断句、幻觉、专有名词的识别稳定性好于 qwen3-asr-1.7B
•这是经过浩叔认真评测一周的选择,感兴趣可以看浩叔发的评测视频
•===============================
•解决日语专用模型复杂场景会漏句问题,会使用多语种-增强模型作次漏句补录
•优化转录引擎,提升初始化时候的稳定性,避免 client 调用时候执行前后抛出异常报报错
•优化转录引擎,Windows 下 GPU 利用率拉到 50%,之所以不拉到 90% ,因为会显著增加程序崩溃的风险,而且收益一般
•===============================
•===============================
•新的对齐模型与算法,Mac 提升 200% 的对齐速度,windows下提升 50%的对齐速度,需要下载新的对齐模型-V2
•兼容部分 Windows 报对齐失败的错误(GPU 驱动问题)
•兼容部分 Windows 报 vad Init 错误的 bug
•===============================
•修复日语转录 数字 英文没有很好的合并,导致的断句异常
•===============================
•大优化日语模型执行算法,提升日语模型识别准确度 10%,特别是在专有名词识别上
•修正部分 Windows 老用户执行达芬奇插件转录时,报异常的错误
•修正 AI 拆行后部分句子会丢失最后一个字的问题
•===============================
•运行达芬奇插件如果显示找不到程序,打开 haoone 软件 在设置中启用命令行工具
•优化日语的对齐算法,适配 BGM 很大声时,区块结尾有较长错误问题
•修正部分 Windows 转录后程序会假死的问题
•修正部分 windows 任务运行对齐会降级成 cpu 的问题
•修正 windows 部分执行任务会出现局部对齐失败的 bug
•===============================
•修正 Windows 下 haoone-cli 执行长时无响应的问题,达芬奇、PR 插件也受影响,表现为一直无响应,请更新软件到最新版本
•用户现在可以自定义模型位置,避免 C 盘磁盘空间不够的问题,不要放在机械硬盘
•haoai 的系列软件可以共享使用模型,只要指向到模型目录会自动匹配模型
•===============================
•发布正式版 client与 skill,第一个版本支持转录、批量转录、文稿匹配、批量添加热词等12个子命令
•haoone-cli 与haoone-skill 基础功能免费开放给所有用户使用,付费用户将开放全功能
•haoone-skill 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-skill
•haoone-skill github仓库://github.com/minghe36/haoone-skill
•使用举例:在 claude code 中:帮我将下面视频文件:XX 转录出字幕文件
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•新增日语专用模型,parakeet-tdt-0.6b-ja,执行速度极快,准确率 94%以上
•日语的 ASR 模型评测,感兴趣的小伙伴可以看:https://www.bilibili.com/video/BV1ReLq6BEUN
•浩叔花了很多时间评测,为大家带来最合适的日语模型
•提升日语专用模型的转录速度再提升 30%,速度快的惊人,30 分钟日语视频,3 分钟内转录完成
•升级 AI 校正为 AI 识错与纠错,逻辑改成双 LLM 模式:第一步先使用 LLM寻找疑似错误名词,第二步使用LLM 进行纠错
•这样做的优势是 1 尽可能的识别出句子的错误,2 可以二次修改 AI 纠错的词,3 可以一键批量添加到热词表
•缺点是需要额外消耗一次大模型 tokens,效果优先,依旧只算 1 次 AI 调用次数
•高识别率/高对齐率/高性能的 ASR 模型执行引擎+智能拆行+AI 识错 + AI 纠错纠错+AI 热词替换
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•增加转录并发数设置,mac 使用自动设置即可,会自动将 GPU 利用率占满,windows 下默认没有占满,因为有用户电脑会奔溃,你可以自行设置并发数
•修正部分电脑运行 PR 插件会报找不到 haoone 程序的问题
•修正 PR 插件 windows 生成的文件名问题
•这套组合拳下来,haoone 软件的准确度、纠错效率得到进一步提升
•AI 英文名词校正功能与 AI 识错与纠错重复,效果没那么好,先下线
•修正合成字体 Windows 下中文字体显示乱码问题
•纠错模型升级成 mimo-v2.5-pro,经过测评验证纠错名词更稳定与准确
•修正达芬奇插件使用日语模型出现无法对齐音频的问题
大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•词语级对齐算法适配日语,实现 98% 的对齐精度
•开放 多语种-增强-2026 模型的日语转录,已经完成优化
•
大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
•增加 AI 专有名词校正,付费用户可以不限调用次数使用
•AI 拆行、AI 热词替换、 AI 专有名词校正 只走官方 LLM API,提升处理速度
•修正 client 端远程转录会执行二次 AI 校正的问题
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
•修正达芬奇插件远程转录时的出现英文字符的 bug
•可以在设置页面启用命令行工具 haoone-cli,老用户强烈开启
•开启后,达芬奇插件/PR 插件将使用新的命令行程序,提升调用兼容性与响应速度
统一字幕后处理的流程
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•优化转录引擎提升 mac 下模型初始化冷启动速度
•增加转录设置页面,可以设置转录的片段之间的贴合规则、中英空格、语气词删除开关
显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•AI 拆行与 AI 热词替换不走用户的自定义 API 端点,减少用户的 token 消耗与响应速度
•API 端点支持本地大模型 server(不需要填入 key)
•修正 windows部分达芬奇插件,转录时部分片段会出现对齐异常问题
•新的命令行工具不带 GUI,可以解决达芬奇/PR 插件 windows 出现无响应haoone GUI 界面的问题
•haoone-cli 使用文档:https://guide.haoai.pro/guide/haoone/%E4%BD%BF%E7%94%A8haoone-cli%E5%91%BD%E4%BB%A4%E8%A1%8C%E5%B7%A5%E5%85%B7\
•haoone-cli github 仓库:https://github.com/minghe36/haoone-cli
•
===============================
•大优化转录引擎,转录速度提升 10%,降低内存/显存占用 30%,提升转录时的稳定性与显卡兼容性
•haoone 的转录引擎来自浩叔花了大量时间深度优化,区别于市面上的其他软件
•多语种-增强-2026 模型(qwen3-asr 1.7B)针对性加速优化,强烈推荐优先使用此模型,转录准确度超过剪映
•使用新的语音检测模型,语音片段识别更精准,增加歌曲的识别,支持粤语、闽南语歌曲识别
•进一步优化中文词语级对齐,修正一些异常对齐 badcase
•显著提升中文数字转换速度,中文日期修正,修正qwen3-asr中文数字处理的bad case
•修正部分 windows 运行达芬奇插件会报错的问题
•修正部分 windows下使用多语种-增强-2026 模型不生效的问题
•优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题
•
优化qwen3-asr 的断句,避免出现比较碎的字幕片段
•修复程序没有清理占位符__HAOONE_MERGED_CLAUSE_SPACE__ 的问题