jikefan

  • 最新
  • AI工具
    • AI绘图设计
    • AI视频生成
    • AI编程助手
    • AI办公写作
    • AI音频语音
    • AI对话问答
    • AI智能体
  • 实用
    • 办公文档
    • 社交沟通
    • 浏览器
    • 网络传输
    • 效率增强
    • 学习教育
    • 生活理财
    • 影音播放
    • 游戏工具
    • 压缩解压
  • 设计开发
    • 设计创作
    • CAD制图
    • 3D动画
    • 开发工具
    • 数据库
    • 多媒体
    • 字体素材
  • 系统
    • 操作系统
    • 系统工具
    • 硬件工具
    • 桌面美化
    • 安全防护
    • 备份恢复
    • 虚拟机
    • 启动盘
  • 专题
    • 免费软件
    • 开源软件
    • 装机必备
    • 软件测评
  1. 首页
  2. / AI音频语音
分类
全部 AI绘图设计 AI视频生成 AI编程助手 AI办公写作 AI音频语音 AI对话问答 AI智能体
设备
全部 Windows macOS Linux Android iOS HarmonyOS Web
属性
全部 免费 开源
清除
  • RVC:开源音色转换框架,10 分钟语音数据即可训练,端到端延迟 170 毫秒

    RVC 是一个开源的语音音色转换与实时变声框架:官方推荐至少收集 10 分钟低底噪语音数据用于训练,端到端延迟可以做到 170 毫秒,并配有网页界面与实时变声界面,以 MIT 许可证开源。

    2026-09-17 AI音频语音
    64
  • Demucs:开源音源分离模型,命令行一行拆出四条音轨

    Demucs 是一个开源的音源分离模型,能把一首歌里的鼓、贝斯与人声分别拆出来;命令行一行即可运行,也能从 Python 直接调用,代码以 MIT 许可证开源。

    2026-09-17 AI音频语音
    59
  • Ultimate Vocal Remover:开源人声分离,干声与伴奏一键提取

    UVR 是一个开源的人声分离工具,用先进的音源分离模型把音频拆成人声与伴奏两条音轨;官方安装包已内置界面、Python 与 PyTorch,下载后装上就能用,不需要额外配环境。

    2026-09-17 AI音频语音
    81
  • WhisperX:70 倍实时的开源转写工具,输出词级时间戳与说话人标签

    WhisperX 把转写串成流水线:先用 faster-whisper 批量转写,再用 wav2vec2 强制对齐拿到词级时间戳,最后由 pyannote 区分说话人。

    2026-09-17 AI音频语音
    43
  • Buzz:离线转写与翻译音频的桌面工具,由 Whisper 提供支持

    Buzz 是一个能在个人电脑上离线转写与翻译音频的桌面工具,由 Whisper 驱动;支持转写音视频文件、麦克风实时转写与说话人识别,结果可导出 SRT 与 VTT 字幕。

    2026-09-17 AI音频语音
    36
  • Whisper:从 3900 万参数到 15.5 亿参数,六种尺寸按显存和精度挑

    Whisper 是一个通用语音识别模型,同一个模型就能做多语言转写、翻译与语种判断;提供从 3900 万到 15.5 亿参数的六种尺寸,代码与权重都是 MIT 许可。

    2026-09-17 AI音频语音
    29
  • IndexTTS:本地部署的零样本语音合成,情感强度与语速都能用参数调

    IndexTTS 是一个零样本文本转语音系统,一段参考音频就能克隆声音;最新版支持五种语言,还能用情感向量、语速系数与拼音发音控制来调节合成细节,也支持半精度推理与 vLLM 部署。

    2026-09-17 AI音频语音
    44
  • F5-TTS:开源语音合成模型,代码是 MIT 许可而预训练模型限非商用

    F5-TTS 是一个用流匹配做语音合成的开源项目,提供 pip 安装、命令行推理与 Gradio 网页界面;代码是 MIT 许可,预训练模型因训练数据限制只能非商用。

    2026-09-17 AI音频语音
    48
  • CosyVoice:零样本克隆声音的开源语音合成,覆盖九种语言与十八种中文方言

    CosyVoice 是一个开源的语音合成模型,最新版本 Fun-CosyVoice 3.0 支持零样本跨语言克隆声音,覆盖九种外语与十多种中文方言,以 Apache 2.0 许可证开源。

    2026-09-17 AI音频语音
    32
  • GPT-SoVITS:1 分钟语音数据就能微调出 TTS 模型,5 秒样本即可零样本合成

    GPT-SoVITS 是一个开源的语音合成 WebUI:输入 5 秒人声就能零样本合成,1 分钟语音数据即可微调出相似度更高的音色,还支持跨中英日韩粤五种语言推理。

    2026-09-17 AI音频语音
    61
  • 第 1 / 1 页
    前微截图录屏

    最新发布

    • Yandex Browser 上手:Turbo 加速、AI 总结一个不少

      Yandex Browser 上手:Turbo 加速、AI 总结一个不少

      2026-09-22

    • 一个命令行压缩器凭什么成为研究标杆:PAQ8px

      一个命令行压缩器凭什么成为研究标杆:PAQ8px

      2026-09-22

    • 从老牌开源浏览器硬分叉:Pale Moon 把主权拿回自己手里

      从老牌开源浏览器硬分叉:Pale Moon 把主权拿回自己手里

      2026-09-22

    • BlackArch Linux 上手:2800+ 工具的安全研究发行版

      BlackArch Linux 上手:2800+ 工具的安全研究发行版

      2026-09-22

    • LXDE 还活着:主线让位 LXQt 后,轻量桌面的坚守者

      LXDE 还活着:主线让位 LXQt 后,轻量桌面的坚守者

      2026-09-22

    • 开源字幕神器 Subtitle Edit:AI 转录加 OCR 一站搞定

      开源字幕神器 Subtitle Edit:AI 转录加 OCR 一站搞定

      2026-09-22

    • GeForce NOW 上手:已有游戏库直接串流,免费档先体验

      GeForce NOW 上手:已有游戏库直接串流,免费档先体验

      2026-09-22

    • Devin Desktop:Windsurf 更名后,成了 Agent 指挥中心

      Devin Desktop:Windsurf 更名后,成了 Agent 指挥中心

      2026-09-22

    • 2.4 稳定版来了:Duplicati 的整盘镜像与同步模式

      2.4 稳定版来了:Duplicati 的整盘镜像与同步模式

      2026-09-22

    • 谁在看、看了什么:开源工具 Tautulli 一目了然

      谁在看、看了什么:开源工具 Tautulli 一目了然

      2026-09-22

    极客范®
    软件推荐与技术分享平台

    发现优质软件,探索技术乐趣,
    与极客一起提升效率与创造力。

    导航

    最新 AI工具 实用 设计开发 系统 专题

    关于

    关注我们 福利社 免责声明 隐私政策 使用条款 联系我们

    帮助

    常见问题 投稿推荐 软件求助 反馈建议

    联系我们

    calljkf@qq.com
    极客范公众号二维码 关注公众号
    获取最新推荐

    极客范® 为软件推荐与技术分享平台,所展示的软件均来自第三方开发者,相关版权归原权利人所有。
    本站仅提供信息介绍及下载指引,不参与软件开发、修改或分发。部分资源提供校验值(如MD5)供用户验证文件完整性。

    © 2022-2026 极客范® 保留所有权利

    本站内容仅供学习与交流,请勿用于商业用途

    蜀ICP备2022020606号-1 | 川公网安备 51015602000452号