haoone - 更新日志 | haoai更新日志
haoone
最新版本: v13.2.1共 50 个版本
发布时间: 2026年9月13日文件大小: 84.7 MB
•提升模型下载中国下载源 1 的下载速度
•修正模型下载中国下载源 2 非激活用户下载报错的问题
•===============================
•去掉软件的强制登录要求
•去掉软件 session 过期后需要重新登陆的要求
•现在可以在软件中解除激活码绑定
•断网情况下,可以使用本地转录
•重新调整激活码激活的流程与逻辑,与 haocut 保持一致
•===============================
•新增本地人声提取功能,支持降噪并分离人声。可以优化强噪下识别准确率与说话人识别,特别适合 户外 vlog 的场景
•本地转录新增“提取人声”开关,并增加使用场景提示。
•开启后会在 VAD 和转录前先执行人声提取,进度条同步显示处理进度。
•修复视频画面仍播放原始音轨、导致人声提取结果未生效的问题。
•将 deepseek-v4-flash 统一更名为 deepseek-flash,升级为 deepseek-v4.1-flash,使用官网定价
•修复预览正常、合成到视频后中英文字幕重叠的问题。
•导出端现在与预览使用一致的双语字幕堆叠规则。
•支持多行字幕、不同字号和不同设计分辨率下的动态排版。
•===============================
•字幕与音频对齐模型中的“默认-v2”更名为“中文”。
•对齐模型默认仅显示首行,新增“显示更多语言 / 收起”功能。
•热词按转录语言严格隔离,不再为非中文转录混入中文或其他语言热词。
•修复 Mimo v2.5 英文远程转录未清理字幕末尾句号的问题。
•为德语、法语、韩语、西班牙语等多种语言增加对应语气词清理。
•非中文转录同时清理模型幻觉产生的“啊、嗯、哦”等中文语气词。
•支持清理带标点、大小写变化以及没有词级时间戳的语气词片段。
•修复删除远距离语气词后,上一条字幕结束时间被错误拉长的问题。
•修复拖拽一个媒体文件却出现两个相同文件的问题。
•===============================
•软件界面完成多语言适配,支持切换成英语或日语。
•如果软件界面是非中文的,模型下载源只使用海外下载源。
•转录的默认语言会跟随系统语言调整。
•逐步会完成软件网站、帮助教程的多语言适配,接入美金支付方式
•达芬奇插件、PR 插件还未完成多语言适配
v13.2.0
发布时间: 2026年9月12日文件大小: 84.7 MB
•去掉软件的强制登录要求
•去掉软件 session 过期后需要重新登陆的要求
•现在可以在软件中解除激活码绑定
•断网情况下,可以使用本地转录
•重新调整激活码激活的流程与逻辑,与 haocut 保持一致
•===============================
•新增本地人声提取功能,支持降噪并分离人声。可以优化强噪下识别准确率与说话人识别,特别适合 户外 vlog 的场景
•本地转录新增“提取人声”开关,并增加使用场景提示。
•开启后会在 VAD 和转录前先执行人声提取,进度条同步显示处理进度。
•修复视频画面仍播放原始音轨、导致人声提取结果未生效的问题。
•将 deepseek-v4-flash 统一更名为 deepseek-flash,升级为 deepseek-v4.1-flash,使用官网定价
•修复预览正常、合成到视频后中英文字幕重叠的问题。
•导出端现在与预览使用一致的双语字幕堆叠规则。
•支持多行字幕、不同字号和不同设计分辨率下的动态排版。
•===============================
•字幕与音频对齐模型中的“默认-v2”更名为“中文”。
•对齐模型默认仅显示首行,新增“显示更多语言 / 收起”功能。
•热词按转录语言严格隔离,不再为非中文转录混入中文或其他语言热词。
v13.1.0
发布时间: 2026年9月11日文件大小: 84.7 MB
•新增本地人声提取功能,支持降噪并分离人声。可以优化强噪下识别准确率与说话人识别,特别适合 户外 vlog 的场景
•本地转录新增“提取人声”开关,并增加使用场景提示。
•开启后会在 VAD 和转录前先执行人声提取,进度条同步显示处理进度。
•修复视频画面仍播放原始音轨、导致人声提取结果未生效的问题。
•将 deepseek-v4-flash 统一更名为 deepseek-flash,升级为 deepseek-v4.1-flash,使用官网定价
•修复预览正常、合成到视频后中英文字幕重叠的问题。
•导出端现在与预览使用一致的双语字幕堆叠规则。
•支持多行字幕、不同字号和不同设计分辨率下的动态排版。
•===============================
•字幕与音频对齐模型中的“默认-v2”更名为“中文”。
•对齐模型默认仅显示首行,新增“显示更多语言 / 收起”功能。
•热词按转录语言严格隔离,不再为非中文转录混入中文或其他语言热词。
•修复 Mimo v2.5 英文远程转录未清理字幕末尾句号的问题。
•为德语、法语、韩语、西班牙语等多种语言增加对应语气词清理。
•非中文转录同时清理模型幻觉产生的“啊、嗯、哦”等中文语气词。
•支持清理带标点、大小写变化以及没有词级时间戳的语气词片段。
•修复删除远距离语气词后,上一条字幕结束时间被错误拉长的问题。
•修复拖拽一个媒体文件却出现两个相同文件的问题。
v13.0.1
发布时间: 2026年9月9日文件大小: 84.6 MB
•字幕与音频对齐模型中的“默认-v2”更名为“中文”。
•对齐模型默认仅显示首行,新增“显示更多语言 / 收起”功能。
•热词按转录语言严格隔离,不再为非中文转录混入中文或其他语言热词。
•修复 Mimo v2.5 英文远程转录未清理字幕末尾句号的问题。
•为德语、法语、韩语、西班牙语等多种语言增加对应语气词清理。
•非中文转录同时清理模型幻觉产生的“啊、嗯、哦”等中文语气词。
•支持清理带标点、大小写变化以及没有词级时间戳的语气词片段。
•修复删除远距离语气词后,上一条字幕结束时间被错误拉长的问题。
•修复拖拽一个媒体文件却出现两个相同文件的问题。
•===============================
•软件界面完成多语言适配,支持切换成英语或日语。
•如果软件界面是非中文的,模型下载源只使用海外下载源。
•转录的默认语言会跟随系统语言调整。
•逐步会完成软件网站、帮助教程的多语言适配,接入美金支付方式
•达芬奇插件、PR 插件还未完成多语言适配
v13.0.0
发布时间: 2026年9月7日文件大小: 84.6 MB
•软件界面完成多语言适配,支持切换成英语或日语。
•如果软件界面是非中文的,模型下载源只使用海外下载源。
•转录的默认语言会跟随系统语言调整。
•逐步会完成软件网站、帮助教程的多语言适配,接入美金支付方式
•达芬奇插件、PR 插件还未完成多语言适配
v12.10.0
发布时间: 2026年9月6日文件大小: 84.5 MB
•优化对齐算法,显著优化字幕行尾部对齐效果
•进一步优化二个独立句子被合并成一行的问题,这是 qwen3-asr 的断句bug,做了下特别补丁
•增加翻译词库功能
•现在翻译、批量翻译支持配置词语翻译规则了
•增加异常幻觉的情况
•修正 windows 下的指令集配置问题
•修正部分 windows 用户点击下载字幕动画会崩溃的问题
•修正 AMD CPU 启动应用奔溃问题
•===============================
•修正合成时报找不到 ffprobe 的 bug
•修正导入文件 ffprobe 降级的 bug
•===============================
•增加泰语的支持,泰语的分词做了针对性优化
•增加印尼语的支持
•增加越南语的支持
•增加印地语的支持
•修正阿拉伯语词语级对齐的 bug
•修正二个句子(间隔时间很长)但被放在一起的问题
•搜索定位只在命中的字幕索引真正变化时触发,不再因播放进度重渲染而反复跳回句首
•
v12.9.1
发布时间: 2026年9月4日文件大小: 84.5 MB
•修正合成时报找不到 ffprobe 的 bug
•修正导入文件 ffprobe 降级的 bug
•===============================
•增加泰语的支持,泰语的分词做了针对性优化
•增加印尼语的支持
•增加越南语的支持
•增加印地语的支持
•修正阿拉伯语词语级对齐的 bug
•修正二个句子(间隔时间很长)但被放在一起的问题
•搜索定位只在命中的字幕索引真正变化时触发,不再因播放进度重渲染而反复跳回句首
•双语搜索可搜索副字幕并正确定位
•暂停状态下不再忽略小于 0.5s 的 seek。此前媒体仍停在句首之后,导致重新播放时漏掉前几个字;现在超过1ms 的用户定位都会准确同步。
•===============================
•增加韩语的支持,在qwen3.asr-1.7B 模型韩语做了部分优化
•AI纠错增加韩语的特别处理
•AI拆行增加韩语的特别处理
•增加韩语空格的特殊处理
•修正韩语 AI 纠错错误回退到中文热词的问题
•修正韩语标点拆分后大量原始词间空格丢失的问题
v12.9.0
发布时间: 2026年9月3日文件大小: 59.4 MB
•增加泰语的支持,泰语的分词做了针对性优化
•增加印尼语的支持
•增加越南语的支持
•增加印地语的支持
•修正阿拉伯语词语级对齐的 bug
•修正二个句子(间隔时间很长)但被放在一起的问题
•搜索定位只在命中的字幕索引真正变化时触发,不再因播放进度重渲染而反复跳回句首
•双语搜索可搜索副字幕并正确定位
•暂停状态下不再忽略小于 0.5s 的 seek。此前媒体仍停在句首之后,导致重新播放时漏掉前几个字;现在超过1ms 的用户定位都会准确同步。
•===============================
•增加韩语的支持,在qwen3.asr-1.7B 模型韩语做了部分优化
•AI纠错增加韩语的特别处理
•AI拆行增加韩语的特别处理
•增加韩语空格的特殊处理
•修正韩语 AI 纠错错误回退到中文热词的问题
•修正韩语标点拆分后大量原始词间空格丢失的问题
•清理最终字幕条目首尾空格,词间空格合并到前一个词,并优化韩语数字与量词之间的断句
•===============================
•纠错增加日语专用规则
v12.8.0
发布时间: 2026年9月2日文件大小: 55.6 MB
•增加韩语的支持,在qwen3.asr-1.7B 模型韩语做了部分优化
•AI纠错增加韩语的特别处理
•AI拆行增加韩语的特别处理
•增加韩语空格的特殊处理
•修正韩语 AI 纠错错误回退到中文热词的问题
•修正韩语标点拆分后大量原始词间空格丢失的问题
•清理最终字幕条目首尾空格,词间空格合并到前一个词,并优化韩语数字与量词之间的断句
•===============================
•纠错增加日语专用规则
•提升 AI 拆行的执行速度
•模型下载源 2 修正鉴权的 bug
•===============================
•优化模型下载分片并发下载的逻辑,提升下载源 2 的下载速度
•===============================
•优化 AI 拆行的调用逻辑
•优化模型下载海外链路,mimo 模型太大了,固定走个 CDN 源下载,避免影响其他模型下载速度
•===============================
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正添加热词无法点击的问题
v12.7.4
发布时间: 2026年9月1日文件大小: 55.6 MB
•纠错增加日语专用规则
•提升 AI 拆行的执行速度
•模型下载源 2 修正鉴权的 bug
•===============================
•优化模型下载分片并发下载的逻辑,提升下载源 2 的下载速度
•===============================
•优化 AI 拆行的调用逻辑
•优化模型下载海外链路,mimo 模型太大了,固定走个 CDN 源下载,避免影响其他模型下载速度
•===============================
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正添加热词无法点击的问题
•修正竖屏下副语言文字显示太小的问题
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
v12.7.3
发布时间: 2026年9月1日文件大小: 55.6 MB
•纠错增加日语专用规则
•提升 AI 拆行的执行速度
•模型下载源 2 修正鉴权的 bug
•===============================
•优化模型下载分片并发下载的逻辑,提升下载源 2 的下载速度
•===============================
•优化 AI 拆行的调用逻辑
•优化模型下载海外链路,mimo 模型太大了,固定走个 CDN 源下载,避免影响其他模型下载速度
•===============================
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正添加热词无法点击的问题
•修正竖屏下副语言文字显示太小的问题
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
v12.7.2
发布时间: 2026年8月30日文件大小: 55.5 MB
•优化模型下载分片并发下载的逻辑,提升下载源 2 的下载速度
•===============================
•优化 AI 拆行的调用逻辑
•优化模型下载海外链路,mimo 模型太大了,固定走个 CDN 源下载,避免影响其他模型下载速度
•===============================
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正添加热词无法点击的问题
•修正竖屏下副语言文字显示太小的问题
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•优化转录下开关的布局
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•AI快速纠错可以配置不同语言的自定义的规则
v12.7.1
发布时间: 2026年8月30日文件大小: 55.5 MB
•优化 AI 拆行的调用逻辑
•优化模型下载海外链路,mimo 模型太大了,固定走个 CDN 源下载,避免影响其他模型下载速度
•===============================
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正添加热词无法点击的问题
•修正竖屏下副语言文字显示太小的问题
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•优化转录下开关的布局
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•AI快速纠错可以配置不同语言的自定义的规则
•修正远程转录缺少 AI 短句合并 的问题
•修正英语断句保护规则过于严格导致拆行失败的问题
v12.7.0
发布时间: 2026年8月30日文件大小: 55.5 MB
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正添加热词无法点击的问题
•修正竖屏下副语言文字显示太小的问题
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•优化转录下开关的布局
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•AI快速纠错可以配置不同语言的自定义的规则
•修正远程转录缺少 AI 短句合并 的问题
•修正英语断句保护规则过于严格导致拆行失败的问题
•优化 AI 短句错误合并到下一行问题
•修正部分 windows 下载字幕动画程序会崩溃问题
•修正双语时,动画显示异常的问题
•
v12.6.1
发布时间: 2026年8月28日文件大小: 55.5 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•优化转录下开关的布局
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•AI快速纠错可以配置不同语言的自定义的规则
•修正远程转录缺少 AI 短句合并 的问题
•修正英语断句保护规则过于严格导致拆行失败的问题
•优化 AI 短句错误合并到下一行问题
•修正部分 windows 下载字幕动画程序会崩溃问题
•修正双语时,动画显示异常的问题
•===============================
•本地转录与远程转录增加自动说话人识别开关
•增加视频播放器区域的显示与隐藏操作按钮
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•修正葡萄牙语对齐模型下载失败的问题
•===============================
•
v12.6.0
发布时间: 2026年8月28日文件大小: 55.6 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•优化转录下开关的布局
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•AI快速纠错可以配置不同语言的自定义的规则
•修正远程转录缺少 AI 短句合并 的问题
•修正英语断句保护规则过于严格导致拆行失败的问题
•优化 AI 短句错误合并到下一行问题
•修正部分 windows 下载字幕动画程序会崩溃问题
•修正双语时,动画显示异常的问题
•===============================
•本地转录与远程转录增加自动说话人识别开关
•增加视频播放器区域的显示与隐藏操作按钮
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•修正葡萄牙语对齐模型下载失败的问题
•===============================
•
v12.4.0
发布时间: 2026年8月27日文件大小: 55.7 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•本地转录与远程转录增加自动说话人识别开关
•增加视频播放器区域的显示与隐藏操作按钮
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•修正葡萄牙语对齐模型下载失败的问题
•===============================
•修复达芬奇字幕动画插件的显示 bug
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•批量修正字幕组件的毫秒时间转化错误
•修正选中字幕动画没有处理空格的问题
•===============================
•修正应用新组件动画不生效问题
•修正动画效果会错误叠加的问题
•新增 10+ 新的字幕动画
•修正帮助中教程链接错误
•修正部分 windows 下载动画程序会崩溃的问题
•新增动画删除功能
v12.3.5
发布时间: 2026年8月26日文件大小: 55.7 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•修复达芬奇字幕动画插件的显示 bug
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•批量修正字幕组件的毫秒时间转化错误
•修正选中字幕动画没有处理空格的问题
•===============================
•修正应用新组件动画不生效问题
•修正动画效果会错误叠加的问题
•新增 10+ 新的字幕动画
•修正帮助中教程链接错误
•修正部分 windows 下载动画程序会崩溃的问题
•新增动画删除功能
•===============================
•修正AI 生成短句后,执行字幕合成会报错的问题
•修正 AI 短句拆行如果是中文会异常的问题
•修正 AI 短句英文还会拆行的问题
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
v12.3.4
发布时间: 2026年8月25日文件大小: 55.7 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•批量修正字幕组件的毫秒时间转化错误
•修正选中字幕动画没有处理空格的问题
•===============================
•修正应用新组件动画不生效问题
•修正动画效果会错误叠加的问题
•新增 10+ 新的字幕动画
•修正帮助中教程链接错误
•修正部分 windows 下载动画程序会崩溃的问题
•新增动画删除功能
•===============================
•修正AI 生成短句后,执行字幕合成会报错的问题
•修正 AI 短句拆行如果是中文会异常的问题
•修正 AI 短句英文还会拆行的问题
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•增加合并后自动添加逗号的开关
•翻译模型默认切成 deepseek-v4-flash
v12.3.3
发布时间: 2026年8月25日文件大小: 55.7 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•修正应用新组件动画不生效问题
•修正动画效果会错误叠加的问题
•新增 10+ 新的字幕动画
•修正帮助中教程链接错误
•修正部分 windows 下载动画程序会崩溃的问题
•新增动画删除功能
•===============================
•修正AI 生成短句后,执行字幕合成会报错的问题
•修正 AI 短句拆行如果是中文会异常的问题
•修正 AI 短句英文还会拆行的问题
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•增加合并后自动添加逗号的开关
•翻译模型默认切成 deepseek-v4-flash
•修正副语言无法加载字幕动画的 bug
•修正部分字幕动画会拆成多行的问题
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
v12.3.2
发布时间: 2026年8月24日文件大小: 55.6 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•修正AI 生成短句后,执行字幕合成会报错的问题
•修正 AI 短句拆行如果是中文会异常的问题
•修正 AI 短句英文还会拆行的问题
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•增加合并后自动添加逗号的开关
•翻译模型默认切成 deepseek-v4-flash
•修正副语言无法加载字幕动画的 bug
•修正部分字幕动画会拆成多行的问题
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•记忆用户的横屏竖屏选择
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•导出字幕动画增加分辨率控制、竖屏横屏控制
•增加 AI 生成短句,用于竖屏的逐字动画
•视频播放器增加横屏竖屏控制
v12.3.1
发布时间: 2026年8月24日文件大小: 55.6 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•增加合并后自动添加逗号的开关
•翻译模型默认切成 deepseek-v4-flash
•修正副语言无法加载字幕动画的 bug
•修正部分字幕动画会拆成多行的问题
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•记忆用户的横屏竖屏选择
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•导出字幕动画增加分辨率控制、竖屏横屏控制
•增加 AI 生成短句,用于竖屏的逐字动画
•视频播放器增加横屏竖屏控制
•优化时间线上的文字,增加快捷操作按钮,方便操作
•修正 enter 拆分句子,滚动条会回滚的问题
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
v12.3.0
发布时间: 2026年8月23日文件大小: 55.6 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•记忆用户的横屏竖屏选择
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•导出字幕动画增加分辨率控制、竖屏横屏控制
•增加 AI 生成短句,用于竖屏的逐字动画
•视频播放器增加横屏竖屏控制
•优化时间线上的文字,增加快捷操作按钮,方便操作
•修正 enter 拆分句子,滚动条会回滚的问题
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•新的中文、英文数字格式化模型,更好的格式化效果
•增加组件动画配置记忆功能,减少手动配置次数
•修正英文的转录字幕动画单词之间缺少空格的问题
•
v12.2.1
发布时间: 2026年8月23日文件大小: 55.4 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•导出字幕动画增加分辨率控制、竖屏横屏控制
•视频播放器增加横屏竖屏控制
•优化时间线上的文字,增加快捷操作按钮,方便操作
•修正 enter 拆分句子,滚动条会回滚的问题
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•新的中文、英文数字格式化模型,更好的格式化效果
•增加组件动画配置记忆功能,减少手动配置次数
•修正英文的转录字幕动画单词之间缺少空格的问题
•转录增加 “保留句末标点” 的配置
•转录增加 “中文与数字是否加空格” 的配置
•===============================
•修正中文字体应用不生效的问题
•修正线上版本动画列表加载失败的问题
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
v12.2.0
发布时间: 2026年8月22日文件大小: 55.4 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•新的中文、英文数字格式化模型,更好的格式化效果
•增加组件动画配置记忆功能,减少手动配置次数
•修正英文的转录字幕动画单词之间缺少空格的问题
•转录增加 “保留句末标点” 的配置
•转录增加 “中文与数字是否加空格” 的配置
•===============================
•修正中文字体应用不生效的问题
•修正线上版本动画列表加载失败的问题
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画的下载与配置
v12.1.0
发布时间: 2026年8月21日文件大小: 55.3 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•新的中文、英文数字格式化模型,更好的格式化效果
•增加组件动画配置记忆功能,减少手动配置次数
•修正英文的转录字幕动画单词之间缺少空格的问题
•转录增加 “保留句末标点” 的配置
•转录增加 “中文与数字是否加空格” 的配置
•===============================
•修正中文字体应用不生效的问题
•修正线上版本动画列表加载失败的问题
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画的下载与配置
•记忆用户的字体选择
•可以将字幕动画快速合并到视频中
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•字幕动画适配竖拍视频
v12.0.1
发布时间: 2026年8月21日文件大小: 52.8 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•修正中文字体应用不生效的问题
•修正线上版本动画列表加载失败的问题
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画的下载与配置
•记忆用户的字体选择
•可以将字幕动画快速合并到视频中
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•字幕动画适配竖拍视频
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•自动处理双语字幕的定位
•修正远程转录后,执行说话人识别报错问题
•修正字幕动画预览与实际合成不一致的问题
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
v12.0.0
发布时间: 2026年8月21日文件大小: 52.8 MB
•V12 版本快速迭代中,可能会有不稳定的情况,有问题请下载 V11 版本
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画的下载与配置
•记忆用户的字体选择
•可以将字幕动画快速合并到视频中
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•字幕动画适配竖拍视频
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•自动处理双语字幕的定位
•修正远程转录后,执行说话人识别报错问题
•修正字幕动画预览与实际合成不一致的问题
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正删除时没有删除对应转录文件的问题
•修正qwen3 asr 存在部分段落漏转录的问题
v11.8.5
发布时间: 2026年8月16日文件大小: 52.5 MB
•增加阿拉伯语的支持
•增加 葡萄牙语 西班牙语 阿拉伯语 意大利语 德语 法语 专用对齐模型,提升对应语言的对齐度
•===============================
•模型下载增加下载源选择,用户可以自行选择,包含一个海外下载源
•优化模型下载进度展示
•模型下载支持暂停与继续下载,模型下载支持续传
•修正翻译有时会不稳定,报 json 结构错误
•升级 deepseek-v4-flash 模型到最新版本
•文稿匹配失败时抛出详细错误
•修正文稿匹配后说话人信息会被清理的 bug
•===============================
•修正对齐模型下载报错的问题
•修正对齐模型大小显示错误
•字幕编辑器 shift+上下箭头 选中文字
•esc 退出字幕编辑的状态
•===============================
•重新实现英语AI 拆行算法,显著提升长句拆分的合理性
•===============================
•模型下载迁移到新的 CDN 上,提升模型下载的稳定性
v11.8.4
发布时间: 2026年8月14日文件大小: 52.5 MB
•模型下载增加下载源选择,用户可以自行选择,包含一个海外下载源
•优化模型下载进度展示
•模型下载支持暂停与继续下载,模型下载支持续传
•修正翻译有时会不稳定,报 json 结构错误
•升级 deepseek-v4-flash 模型到最新版本
•文稿匹配失败时抛出详细错误
•修正文稿匹配后说话人信息会被清理的 bug
•===============================
•修正对齐模型下载报错的问题
•修正对齐模型大小显示错误
•字幕编辑器 shift+上下箭头 选中文字
•esc 退出字幕编辑的状态
•===============================
•重新实现英语AI 拆行算法,显著提升长句拆分的合理性
•===============================
•模型下载迁移到新的 CDN 上,提升模型下载的稳定性
•显著提升海外用户模型下载的速度
•修正 AI 短句合并会误把相隔一段时间的句子合并到一块的 bug
•修正双语字幕,合成字幕时只有一个语言的问题
v11.8.3
发布时间: 2026年8月13日文件大小: 52.5 MB
•修正对齐模型下载报错的问题
•修正对齐模型大小显示错误
•字幕编辑器 shift+上下箭头 选中文字
•esc 退出字幕编辑的状态
•===============================
•重新实现英语AI 拆行算法,显著提升长句拆分的合理性
•===============================
•模型下载迁移到新的 CDN 上,提升模型下载的稳定性
•显著提升海外用户模型下载的速度
•修正 AI 短句合并会误把相隔一段时间的句子合并到一块的 bug
•修正双语字幕,合成字幕时只有一个语言的问题
•修正合成字幕被降级成 CPU 的问题,恢复 GPU 合成,提升合成速度
•修正百分比转化错误
•修正批量转录中切换文件的异常问题
•翻译时目标语言与当前语言相同,提示用户语言相同无需翻译
•===============================
•进一步优化说话人识别算法,改成二阶段识别,短语音不参与第一阶段聚类。
•提升说话人匹配效果
•===============================
v11.8.2
发布时间: 2026年8月11日文件大小: 52.5 MB
•重新实现英语AI 拆行算法,显著提升长句拆分的合理性
•===============================
•模型下载迁移到新的 CDN 上,提升模型下载的稳定性
•显著提升海外用户模型下载的速度
•修正 AI 短句合并会误把相隔一段时间的句子合并到一块的 bug
•修正双语字幕,合成字幕时只有一个语言的问题
•修正合成字幕被降级成 CPU 的问题,恢复 GPU 合成,提升合成速度
•修正百分比转化错误
•修正批量转录中切换文件的异常问题
•翻译时目标语言与当前语言相同,提示用户语言相同无需翻译
•===============================
•进一步优化说话人识别算法,改成二阶段识别,短语音不参与第一阶段聚类。
•提升说话人匹配效果
•===============================
•增加导入 srt 字幕功能,强大的点是,软件可以给导入的 srt 字幕补充词语级时间戳数据
•重新调整说话人识别算法,显著优化说话人的识别精度,特别是短句的识别
•已注册说话人支持搜索
•修改说话人后不自动关闭弹层
•===============================
v11.8.1
发布时间: 2026年8月11日文件大小: 52.4 MB
•模型下载迁移到新的 CDN 上,提升模型下载的稳定性
•显著提升海外用户模型下载的速度
•修正 AI 短句合并会误把相隔一段时间的句子合并到一块的 bug
•修正双语字幕,合成字幕时只有一个语言的问题
•修正合成字幕被降级成 CPU 的问题,恢复 GPU 合成,提升合成速度
•修正百分比转化错误
•修正批量转录中切换文件的异常问题
•翻译时目标语言与当前语言相同,提示用户语言相同无需翻译
•===============================
•进一步优化说话人识别算法,改成二阶段识别,短语音不参与第一阶段聚类。
•提升说话人匹配效果
•===============================
•增加导入 srt 字幕功能,强大的点是,软件可以给导入的 srt 字幕补充词语级时间戳数据
•重新调整说话人识别算法,显著优化说话人的识别精度,特别是短句的识别
•已注册说话人支持搜索
•修改说话人后不自动关闭弹层
•===============================
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
v11.8.0
发布时间: 2026年8月11日文件大小: 52.3 MB
•模型下载迁移到新的 CDN 上,提升模型下载的稳定性
•提升海外用户模型下载的速度
•===============================
•进一步优化说话人识别算法,改成二阶段识别,短语音不参与第一阶段聚类。
•提升说话人匹配效果
•===============================
•增加导入 srt 字幕功能,强大的点是,软件可以给导入的 srt 字幕补充词语级时间戳数据
•重新调整说话人识别算法,显著优化说话人的识别精度,特别是短句的识别
•已注册说话人支持搜索
•修改说话人后不自动关闭弹层
•===============================
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
•批量转录增加 AI 短句自动合并
•命令行工具增加 AI 短句自动合并 开关
•多语言导出时自动导出单语言的字幕文件
•修正部分情况中文的译文会有错位的问题
•修正会有额外补充翻译的问题
•去掉esc 快捷键的绑定
v11.7.1
发布时间: 2026年8月10日文件大小: 52.3 MB
•进一步优化说话人识别算法,改成二阶段识别,短语音不参与第一阶段聚类。
•提升说话人匹配效果
•===============================
•增加导入 srt 字幕功能,强大的点是,软件可以给导入的 srt 字幕补充词语级时间戳数据
•重新调整说话人识别算法,显著优化说话人的识别精度,特别是短句的识别
•已注册说话人支持搜索
•修改说话人后不自动关闭弹层
•===============================
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
•批量转录增加 AI 短句自动合并
•命令行工具增加 AI 短句自动合并 开关
•多语言导出时自动导出单语言的字幕文件
•修正部分情况中文的译文会有错位的问题
•修正会有额外补充翻译的问题
•去掉esc 快捷键的绑定
•===============================
•修正英语转录后出现重复字幕问题
•修正英语转录后部分句子异常拆行问题
v11.7.0
发布时间: 2026年8月9日文件大小: 52.4 MB
•增加导入 srt 字幕功能,强大的点是,软件可以给导入的 srt 字幕补充词语级时间戳数据
•重新调整说话人识别算法,显著优化说话人的识别精度,特别是短句的识别
•已注册说话人支持搜索
•修改说话人后不自动关闭弹层
•===============================
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
•批量转录增加 AI 短句自动合并
•命令行工具增加 AI 短句自动合并 开关
•多语言导出时自动导出单语言的字幕文件
•修正部分情况中文的译文会有错位的问题
•修正会有额外补充翻译的问题
•去掉esc 快捷键的绑定
•===============================
•修正英语转录后出现重复字幕问题
•修正英语转录后部分句子异常拆行问题
•===============================
•修正达芬奇插件执行文稿匹配报错问题
•修正部分视频文稿匹配会异常的问题
v11.6.0
发布时间: 2026年8月7日文件大小: 52.3 MB
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
•批量转录增加 AI 短句自动合并
•命令行工具增加 AI 短句自动合并 开关
•多语言导出时自动导出单语言的字幕文件
•修正部分情况中文的译文会有错位的问题
•修正会有额外补充翻译的问题
•===============================
•修正英语转录后出现重复字幕问题
•修正英语转录后部分句子异常拆行问题
•===============================
•修正达芬奇插件执行文稿匹配报错问题
•修正部分视频文稿匹配会异常的问题
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•修正部分段落转录失败的 bug
•修正翻译会漏翻译句子的问题
•修正翻译会部分句子会出现相同语句的问题
•===============================
•升级 AI 拆行与热词替换的大模型,提升效果
v11.5.4
发布时间: 2026年8月6日文件大小: 52.2 MB
•修正英语转录后出现重复字幕问题
•修正英语转录后部分句子异常拆行问题
•===============================
•修正达芬奇插件执行文稿匹配报错问题
•修正部分视频文稿匹配会异常的问题
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•修正部分段落转录失败的 bug
•修正翻译会漏翻译句子的问题
•修正翻译会部分句子会出现相同语句的问题
•===============================
•升级 AI 拆行与热词替换的大模型,提升效果
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•达芬奇插件开放所有模型
•PR插件开放所有模型
•修正搜索无法搜索多语言字幕的问题
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
v11.5.3
发布时间: 2026年8月6日文件大小: 52.2 MB
•修正达芬奇插件执行文稿匹配报错问题
•修正部分视频文稿匹配会异常的问题
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•修正部分段落转录失败的 bug
•修正翻译会漏翻译句子的问题
•修正翻译会部分句子会出现相同语句的问题
•===============================
•升级 AI 拆行与热词替换的大模型,提升效果
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•达芬奇插件开放所有模型
•PR插件开放所有模型
•修正搜索无法搜索多语言字幕的问题
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
v11.5.1
发布时间: 2026年8月4日文件大小: 52.2 MB
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•达芬奇插件开放所有模型
•PR插件开放所有模型
•修正搜索无法搜索多语言字幕的问题
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•优化长音频下字幕编辑框的加载性能,避免卡顿
•新增字幕占用时间固定为 500ms
v11.5.2
发布时间: 2026年8月4日文件大小: 52.2 MB
•升级 AI 拆行与热词替换的大模型,提升效果
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•达芬奇插件开放所有模型
•PR插件开放所有模型
•修正搜索无法搜索多语言字幕的问题
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•
v11.5.0
发布时间: 2026年8月2日文件大小: 52.2 MB
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•优化长音频下字幕编辑框的加载性能,避免卡顿
•新增字幕占用时间固定为 500ms
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•优化说话人修改界面,区分单次修改与批量修改
•导出时自动同步双语配置
•修正数字英文之间多余的空格
v11.4.4
发布时间: 2026年7月31日文件大小: 52.2 MB
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•优化长音频下字幕编辑框的加载性能,避免卡顿
•新增字幕占用时间固定为 500ms
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•优化说话人修改界面,区分单次修改与批量修改
•导出时自动同步双语配置
•修正数字英文之间多余的空格
•修正中文数字转化的一个问题
•===============================
•修正多语言下的导出说话人,无法选中说话人问题
•修正字幕输入框不支持 cmd+x 的问题
•字幕输入框适配长英文
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•导出可以导出指定说话人 srt 内容
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
v11.4.3
发布时间: 2026年7月30日文件大小: 52.2 MB
•自定义 API 增加模型选择框,可以自动填入 API url
•优化说话人修改界面,区分单次修改与批量修改
•导出时自动同步双语配置
•修正数字英文之间多余的空格
•修正中文数字转化的一个问题
•===============================
•修正多语言下的导出说话人,无法选中说话人问题
•修正字幕输入框不支持 cmd+x 的问题
•字幕输入框适配长英文
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•导出可以导出指定说话人 srt 内容
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•优化导出弹层样式
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•修正切换文件后字幕内容没有切换的问题
•修正合并字幕操作后,字幕被异常修改的 bug
•二次转录清理掉多语言版本
•合并上一行 下一行 自动加一个空格
•
v11.4.2
发布时间: 2026年7月28日文件大小: 52.0 MB
•修正多语言下的导出说话人,无法选中说话人问题
•修正字幕输入框不支持 cmd+x 的问题
•字幕输入框适配长英文
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•导出可以导出指定说话人 srt 内容
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•优化导出弹层样式
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•修正切换文件后字幕内容没有切换的问题
•修正合并字幕操作后,字幕被异常修改的 bug
•二次转录清理掉多语言版本
•合并上一行 下一行 自动加一个空格
•===============================
•新的翻译操作,整合双语与翻译
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•通过勾选语言的选择来控制展示顺序
•去掉双语配置,双语整合到翻译
•
v11.4.1
发布时间: 2026年7月28日文件大小: 52.0 MB
•导出可以导出指定说话人 srt 内容
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•优化导出弹层样式
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•修正切换文件后字幕内容没有切换的问题
•修正合并字幕操作后,字幕被异常修改的 bug
•二次转录清理掉多语言版本
•合并上一行 下一行 自动加一个空格
•===============================
•新的翻译操作,整合双语与翻译
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•通过勾选语言的选择来控制展示顺序
•去掉双语配置,双语整合到翻译
•支持同时显示二种以上的语言字幕
•批量翻译支持新的翻译多语言模式
•文稿视图支持多语言内容
•导出支持新的翻译模式
•远程转录增加局部转录支持
•haoone-client 命令行工具增加局部转录支持
v11.4.0
发布时间: 2026年7月27日文件大小: 52.0 MB
•新的翻译操作,整合双语与翻译
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•通过勾选语言的选择来控制展示顺序
•去掉双语配置,双语整合到翻译
•支持同时显示二种以上的语言字幕
•批量翻译支持新的翻译多语言模式
•文稿视图支持多语言内容
•导出支持新的翻译模式
•远程转录增加局部转录支持
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
换行,而不是不拆分字幕段
•修正部分长音频音频波形会消失的问题
•修正批量翻译不会显示进度条的问题
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•有了局部转录后,长音频可以实现分段转录的效果
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
v11.3.0
发布时间: 2026年7月25日文件大小: 52.0 MB
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•有了局部转录后,长音频可以实现分段转录的效果
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•修正口语短句被误拆分的问题
•修正英语专有名词有空格的 bug
•修正英语数字 bug
•修正字幕重叠的异常 case
•修正 vad 被强制截断的问题
•修正自动贴合设置开关无效的 bug
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•修正英语转录时候时间线滚动错误的问题
v11.2.0
发布时间: 2026年7月23日文件大小: 52.0 MB
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•修正英语转录时候时间线滚动错误的问题
•===============================
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•感谢小伙伴认可,用软件的小伙伴越来越多,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•修正部分视频音频波形只显示一半的问题
•去掉自动的短句合并逻辑,避免影响说话人判断
•重构说话人分割的逻辑,提升说话人的对应性
•说话人数量可以自动识别
•增加说话人识别模型选择
•去掉说话人分割模型
v11.1.0
发布时间: 2026年7月20日文件大小: 52.0 MB
•V11 版本处于公测阶段,可能会频繁更新,如遇异常,下载V10 版本
•感谢小伙伴认可,用软件的小伙伴越来越多,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•修正部分视频音频波形只显示一半的问题
•去掉自动的短句合并逻辑,避免影响说话人判断
•重构说话人分割的逻辑,提升说话人的对应性
•说话人数量可以自动识别
•增加说话人识别模型选择
•去掉说话人分割模型
•"自动贴合字幕" 不再设置阈值,默认开启
•haoone-client 命令行工具增加说话人识别命令
•修正章节总结视图中说话人显示错误问题
•优化导出的说话人名称
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新增不同说话人分割
•新增说话人设置
•
修复 Mimo v2.5 英文远程转录未清理字幕末尾句号的问题。
•为德语、法语、韩语、西班牙语等多种语言增加对应语气词清理。
•非中文转录同时清理模型幻觉产生的“啊、嗯、哦”等中文语气词。
•支持清理带标点、大小写变化以及没有词级时间戳的语气词片段。
•修复删除远距离语气词后,上一条字幕结束时间被错误拉长的问题。
•===============================
•如果软件界面是非中文的,模型下载源只使用海外下载源。
•逐步会完成软件网站、帮助教程的多语言适配,接入美金支付方式
•===============================
•如果软件界面是非中文的,模型下载源只使用海外下载源。
•逐步会完成软件网站、帮助教程的多语言适配,接入美金支付方式
双语搜索可搜索副字幕并正确定位
•暂停状态下不再忽略小于 0.5s 的 seek。此前媒体仍停在句首之后,导致重新播放时漏掉前几个字;现在超过1ms 的用户定位都会准确同步。
•===============================
•增加韩语的支持,在qwen3.asr-1.7B 模型韩语做了部分优化
•清理最终字幕条目首尾空格,词间空格合并到前一个词,并优化韩语数字与量词之间的断句
•===============================
•===============================
•优化模型下载分片并发下载的逻辑,提升下载源 2 的下载速度
•===============================
•优化模型下载海外链路,mimo 模型太大了,固定走个 CDN 源下载,避免影响其他模型下载速度
•===============================
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•修正部分 windows 下载字幕动画程序会崩溃问题
•===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
清理最终字幕条目首尾空格,词间空格合并到前一个词,并优化韩语数字与量词之间的断句
•===============================
•===============================
•优化模型下载分片并发下载的逻辑,提升下载源 2 的下载速度
•===============================
•优化模型下载海外链路,mimo 模型太大了,固定走个 CDN 源下载,避免影响其他模型下载速度
•===============================
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•修正部分 windows 下载字幕动画程序会崩溃问题
•===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
提升 AI 拆行的执行速度
•===============================
•优化模型下载分片并发下载的逻辑,提升下载源 2 的下载速度
•===============================
•优化模型下载海外链路,mimo 模型太大了,固定走个 CDN 源下载,避免影响其他模型下载速度
•===============================
•下线老的 AI 纠错模式,新的执行速度更快、配置规则更直观
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•修正部分 windows 下载字幕动画程序会崩溃问题
•===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
修正竖屏下副语言文字显示太小的问题
•修正竖屏下部分 windows 看不到 副语言文字的问题
•修正中文数字后处理有 bug :几十年 误处理成了 几 10 年
•修正点击下载字幕动画部分 windows 会崩溃的问题
•修正 moss-transcribe-diarize 模型无法在达芬奇 PR 插件中使用的问题
•===============================
•增加转录后AI快速纠错,纠错会带上热词与说话人人名
•升级软件AI 拆行、短句合并、热词替换默认的模型为最新的 qwen3.8-flash ,测试下来有不错的提升,价格比之前模型贵了20%,给用户带来更好的体验更重要
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•修正部分 windows 下载字幕动画程序会崩溃问题
•===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•修正部分 windows 下载字幕动画程序会崩溃问题
•===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•现在热词替换不依赖网络,热词后替换逻辑整合到了 AI快速纠错
•修正部分 windows 下载字幕动画程序会崩溃问题
•===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
修正远程转录缺少 AI 短句合并 的问题
•修正部分 windows 下载字幕动画程序会崩溃问题
•===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
优化 AI 短句错误合并到下一行问题
•修正部分 windows 下载字幕动画程序会崩溃问题
•===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
===============================
•修正部分 mac 用户执行达芬奇插件时报找不到中文数字格式化模型的错误
•修正达芬奇插件执行 mimo-v2.5-asr 模型时,报错找不到模型的问题
•===============================
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
修复达芬奇字幕动画插件的显示 bug
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
修复达芬奇字幕动画插件的显示 bug
•===============================
•修正达芬奇字幕动画插件应用动画后,动画前面会快速播放乱序内容
•===============================
•修正部分 windows 下载动画程序会崩溃的问题
•===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
===============================
•===============================
•视频处于播放中,点击字幕输入框,编辑字幕态,自动暂停播放
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
增加合并后自动添加逗号的开关
•翻译模型默认切成 deepseek-v4-flash
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
修正副语言无法加载字幕动画的 bug
•===============================
•修正部分音频的部分片段转录为空的问题:Qwen3-ASR 对特定音频块边界可能直接输出 EOS/空文本,修改c++引擎代码,实现VAD 边界二分补录的方式
•增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
增加 AI 短句拆行,用于竖屏时单行显示字幕动画
•达芬奇插件远程转录支持选择 mimo-v2.5-asr
•===============================
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•===============================
•重写英语、德语、法语等语种的长语句拆行算法,优化气口得分与惩罚机制,优化长句拆分的合理性
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•优化 AI 拆行的逻辑,配合 CTC blank 气口拆分算法使用,提升拆分的准确率
•===============================
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
转录增加 “保留句末标点” 的配置
•===============================
•===============================
•字幕合成史诗级加强,现在无需剪映,也可以合成各种动画效果的字幕,全网最强字幕动画的字幕软件
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•第一期实现了 60+ 动画组件,未来会有超过 100+ 字幕动画,包括各种逐字字幕动画
•新增达芬奇字幕动画插件,字幕动画可以快速导入达芬奇,并可以在达芬奇中调整字幕动画效果
•全新的字幕合成功能,新增浩叔自己开发的字幕动画合成引擎,会自动下载合成引擎
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•
记忆用户的字体选择
•增加字幕动画导出功能,可以导出透明背景的字幕动画
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•弥补了达芬奇逐字动画单一少,无法使用其他软件生成的转录结果的问题
•可以设置双语不同的字幕动画样式,副字幕没有时间戳,所以副字幕无法使用
•打开按钮现在 hover 上去可以打开 音频文件、srt 文件、动画文件夹
•修正qwen3 asr 存在部分段落漏转录的问题
•修正qwen3 asr 存在部分段落漏转录的问题
•
显著提升海外用户模型下载的速度
•修正 AI 短句合并会误把相隔一段时间的句子合并到一块的 bug
•修正合成字幕被降级成 CPU 的问题,恢复 GPU 合成,提升合成速度
•翻译时目标语言与当前语言相同,提示用户语言相同无需翻译
•===============================
•进一步优化说话人识别算法,改成二阶段识别,短语音不参与第一阶段聚类。
•===============================
•增加导入 srt 字幕功能,强大的点是,软件可以给导入的 srt 字幕补充词语级时间戳数据
•重新调整说话人识别算法,显著优化说话人的识别精度,特别是短句的识别
•===============================
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
•===============================
•===============================
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•===============================
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
修正合成字幕被降级成 CPU 的问题,恢复 GPU 合成,提升合成速度
•翻译时目标语言与当前语言相同,提示用户语言相同无需翻译
•===============================
•进一步优化说话人识别算法,改成二阶段识别,短语音不参与第一阶段聚类。
•===============================
•增加导入 srt 字幕功能,强大的点是,软件可以给导入的 srt 字幕补充词语级时间戳数据
•重新调整说话人识别算法,显著优化说话人的识别精度,特别是短句的识别
•===============================
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
•===============================
•===============================
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•===============================
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
增加导入 srt 字幕功能,强大的点是,软件可以给导入的 srt 字幕补充词语级时间戳数据
•重新调整说话人识别算法,显著优化说话人的识别精度,特别是短句的识别
•===============================
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
•===============================
•===============================
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•===============================
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•增加 AI 短句自动合并功能,已购买软件用户可以无限次使用
•AI 短句自动合并 会自动判断短句的语义情况与说话人情况,智能合并
•===============================
•===============================
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•===============================
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•===============================
•===============================
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•===============================
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
===============================
•===============================
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•===============================
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
===============================
•修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•===============================
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
修复 bug:删除、合并上一行、合并下一行 按钮点击后,滚动条会向前滚动,有跳跃感
•===============================
•===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
===============================
•解决Windows下 mimo-v2.5-asr GPU 转录失败问题,Windows下开放 mimo-v2.5-asr 模型转录
•===============================
•新增 中英日-多说话人-2026 moss-transcribe-diarize-0.9b ,此模型的评测请看浩叔的 B 站视频
•moss-transcribe-diarize 拥有最好的断句能力,少数能够很好的处理日语断句的模型,日语转录优先使用此模型,适用多说话人复杂语音,会议、播客、综艺、番剧
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•moss-transcribe-diarize 在日语转录时漏句漏词情况显著好于 parakeet-tdt-0.6b-ja
•moss-transcribe-diarize 无法处理混合语音、方言,专有名词识别一般,准确率高于 qwen3-asr-0.6B,低于 qwen3-asr-1.7B,断句显著好于 qwen3-asr
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•moss-transcribe-diarize 在部分特别复杂语音可能会漏句,这时候可以使用软件的局部转录功能,使用其他模型补录
•没有使用 moss-transcribe-diarize 的说话人识别,haoone 自研的说话人识别更准
•===============================
•修正多语言版本,新增字幕后会额外复制下一行字幕,造成联动修改的 bug
•修正长音频下字幕编辑卡顿的问题,解决合并、删除操作全量操作卡顿的问题
•优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
优化长音频下时间线上的字幕区块加载性能,避免卡顿
•===============================
•自定义 API 增加模型选择框,可以自动填入 API url
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•===============================
•修正删除字幕、合并字幕的 字幕编辑异常同步、重复、错位的问题
•===============================
•翻译增加局部翻译的支持,发现部分时间内翻译异常,可以通过局部翻译二次翻译,而不是全量翻译
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
优化导出弹层样式
•修正新增翻译模式后,字幕输入框无法复制粘帖的问题
•===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
===============================
•翻译后,可以在多个语言之间切换,可以同时显示多个语言版本
•多语言字幕分离,可以支持灵活的编辑,不会互相影响
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
支持同时显示二种以上的语言字幕
•haoone-client 命令行工具增加局部转录支持
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•句子视图中增加 Shift + Enter 快捷键:在光标位置插入
•===============================
•增加局部转录功能,可以设置出入点,只转录局部位置的字幕
•有了局部转录后,可以充分发挥软件支持多模型的优点,比如某个段落 qwen-asr 没转录好,可以使用 mimo-v2.5-asr 二次局部转录
•修正英语 AI 拆句破坏语义的问题,请到转录设置,点下重置拆行提示词并保存
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•修正英语长句被不合理拆段的问题,chunk 对于英语太小了
•===============================
•感谢小伙伴认可,6 月份后接口的调用量提升了 120%,数据库服务器吃不消了,做了升级与扩容,如果遇到需要登录的情况是正常现象,session 失效的缘故
•增加moss-transcribe-preview-2b 英语模型,强于 qwen3-asr-1.7B 与 cohere,英语转录几乎与 elevenlabs 相当
•增加英语专用对齐模型,显著改善复杂英语语音的对齐情况
•新的英语专用对齐模型可以实现英语歌曲的高精度对齐
•===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
===============================
•修正升级数据库服务器后,导致邮箱发送邮件失败的问题
•titanet-large 中文与日语识别不准,升级成 wespeaker 模型,新模型支持日语说话人识别
•不同识别模型,因为维度不同,会使用不同的声纹库,无法通用
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•haoone-client 命令行工具增加说话人识别命令
•===============================
•新增说话人识别功能,目前日语说话人不准,后续会新增更强识别模型
•新的快速编辑视图,参考 elevenlabs,升级成段落视图
•
导出字幕文件支持带说话人信息导出
•新的快速编辑视图,参考 elevenlabs,升级成段落视图