您好,欢迎来到 锐星AI网站导航官网 - 国内外1000+AI工具,发现好用AI,为你导航未来!
登录 / 注册 / 找回密码
全新的分类目录站点,点击去提交

数据归档

数据归档

  • MDX23声音分离,一键安装包

    MDX23声音分离,一键安装包

    本整合包修改自MVSEP-MDX23-Colab_v2,原项目为colab部署,作者修改了部分代码使其可以本地运行 该方案在https://mvsep.com/网站上的SDR Vocals得分10.2196,截止打包日为开源模型中得分最高方案,对应参数已按照榜单修改完成。 评价:人声剥离完整,不砍频,测试用的这首很多模型都会把人声剥没一部分,该方案在作者测试中目前表现最好,但是会漏器乐,可能需要额外处理。 2.3版本对比2.2版本 对比2.2版本,主要的变化是换用了新模型,以及配套的新方案和参数。 2.3版本以及配套的参数在mvsep.com上的SDR Vocals得分10.3660,得益于新放出的模型以及其他优化,比之前2.2版本得分高很多,但是代价是处理时间的极大增加。 MVSEP-MDX23,如果你需要运行这个算法进行音源分离,占用显存可达4-15G,低于4G显存,可能运行失败 项目地址:https://github.com/jarredou/MVSEP-MDX23-Colab_v2 下载链接: https://pan.baidu.com/s/14KkRhYMIbqeYooq6mH0Knw?pwd=h9er 解压密码 领航员未鸟 2.2版本视频介绍:https://www.bilibili.com/video/BV1u8411y7P4/ 2.3版本视频介绍:https://www.bilibili.com/video/BV1Gb4y1K7gu

    github.com/jarredou/MVSEP-MDX23-Colab_v2 - 2026-07-04 - 收藏
  • Ultimate Vocal Remover UVR5.6

    Ultimate Vocal Remover UVR5.6

    Ultimate Vocal Remover是一款基于深度神经网络的乐器和人声分离软件,能够高效准确地将音频文件中的不同元素进行分离,并生成高质量的消音伴奏。Ultimate Vocal Remover具有易用性、开源、界面简单、工作流程简单明了、人声移除效果好等特点。 UVR5使用教程和最新连招:https://www.bilibili.com/read/cv27499700/ 百度网盘下载:链接:https://pan.baidu.com/s/1QTWDlF8y0Mw81OzTs53dBg?pwd=qs7c 提取码:qs7c UVR官方仓库:https://github.com/Anjok07/ultimatevocalremovergui UVR闲聊频道:https://discord.gg/P7FhQFH 下载链接: Windows N卡(CUDA加速):https://github.com/Anjok07/ultimatevocalremovergui/releases/download/v5.6/UVR_v5.6.0_setup.exe Windows A卡/I卡(OpenCL加速):https://github.com/Anjok07/ultimatevocalremovergui/releases/download/v5.6/UVR_v5.6.0_setup_opencl.exe MacOS M芯片:https://github.com/Anjok07/ultimatevocalremovergui/releases/download/v5.6/Ultimate_Vocal_Remover_v5_6_MacOS_arm64.dmg MacOS Intel芯片:https://github.com/Anjok07/ultimatevocalremovergui/releases/download/v5.6/Ultimate_Vocal_Remover_v5_6_MacOS_x86_64.dmg 由于苹果的严格管控应用程序的安全性,您可能需要按照以下步骤打开UVR: 首先,使用终端运行以下命令,允许应用程序从所有来源运行: sudo spctl –master-disable 其次,运行以下命令来绕过验证: sudo xattr -rd com.apple.quarantine /Applications/Ultimate Vocal Remover.app Linux:嗯?都用Linux了,用Git拉代码自己部署不是难事吧?欸嘿~ 警告:安装路径必须为全英文!!!不推荐修改默认安装路径,否则会有权限问题!!!

    github.com/Anjok07/ultimatevocalremovergui - 2026-07-04 - 收藏
  • MVSEP – 音乐与语音分离网站

    MVSEP – 音乐与语音分离网站

    这是一个在线声音分离的网站,可以上传您选择的歌曲,并利用目前可用的所有声音分离 AI模型进行处理,模型大致有MDX-net、DEMUCS4、spleeter

    mvsep.com - 2026-07-04 - 收藏
  • 音子AI

    音子AI

    对音视频文件自动消除人声部分,保留背景音乐。去除视频当中的人说话的声音

    www.yinziai.com - 2026-07-04 - 收藏
  • SpleeterGUI 人声分离软件

    SpleeterGUI 人声分离软件

    最新版2.9.4,大概613MB大小,2.9.4版本删除了预训练模型(这些模型将在您使用应用程序时下载)。 以下是搬运阿里云 SpleeterGUl_V2.9.2:https://www.aliyundrive.com/s/YwE2FBcM9Am V2.9.1:https://www.weidown.com/yinpinchuli/17369.html 软件简介: spleetergui,这是一款开源的AI人声伴奏分离工具,基于TensorFlow所开发,且自身运行速度非常快,能够将歌曲拆分成单独的部分,只要配合Deezer发布的AI训练模型,就可以实现相当高质量的人声与伴奏分离,且最高可以分离人声、鼓、贝斯、钢琴、其他 五个音轨,并生成对应的WAV文件,非常简单易用,能够满足用户对音轨分离的基本需求。同时,该软件支持mp3、wav、ogg等罕见音频格式。 软件亮点: 1、简单直观的操作界面,简单几步即可快速的分离音轨。 2、人声(演唱声音)/伴奏分离,可以将人声与伴奏进行分离。 3、人声/鼓/低音/其他分离,可以将人声、鼓、低音与其他音轨进行分离。 4、人声/鼓/低音/钢琴/其他分离,可以支持将人声、鼓、低音、钢琴、其他进行分离。 5、Spleeter GUI提供了多种分离模式,您可以根据自己的需要进行选择。 6、当执行分离操作时,软件界面会冻结,用户无法执行其他分离操作,需要等待完成后方可处理下一个文件。 我最常用的功能,就是将歌曲的伴奏提取出来。软件是纯免费软件。软件是64位的。 使用方法: 非常简单,只需选择分离类型,然后勾选设置条件,比如将输出零件合并在一起、全带宽16Khz高质量,另外还可以将音乐文件拖放到软件中的,在处理分离之前,只需设置好输出路径即可完成整个操作步骤即可。 新手全部默认就可以了。 作者:三膳来迟 https://www.bilibili.com/read/cv16598946/ 出处:bilibili

    makenweb.com/SpleeterGUI - 2026-07-04 - 收藏
  • vocalremover人声分离

    vocalremover人声分离

    以去人声来说,只要导入音乐档案,等候约1~2分钟就能完成,完成后可以看它将音乐跟人声分成二个轨道,你可以自行调整二者的音量后再下载为新的文件,左侧栏还有 去人声、分离器、变调器、调BPM查询器、剪辑器、合并器、录音、卡拉OK

    vocalremover.org - 2026-07-04 - 收藏
  • TME Studio在线音乐创作助手

    TME Studio在线音乐创作助手

    TME Studio是由腾讯音乐娱乐公司推出的一款智能音乐创作助手,由旗下银河音效、MUSE、天琴实验室、Tencent AI Lab共同打造,助力音乐爱好者,让创作更简单。该智能音乐助手目前提供以下AI功能: 音乐分离 基于深度学习技术,上传任意歌曲,分离、提取歌曲中的人声和鼓、贝斯、吉他、钢琴等乐器 MIR计算 通过人工智能和信号处理对音乐进行内容理解与分析,提取音乐的采样率、位深、BPM、节奏、节拍、调性、和弦进行、鼓点识别、副歌识别等信息。通过更深维度的识别与分析挖掘音乐蕴含的更多高层次信息,创造更智能的音乐工具,让机器更懂你的音乐。 辅助写词 腾讯音乐人·天琴实验室推出的一款作词工具,通过分析TME全曲库歌词以及散文、诗歌等多种语料素材,依据智能推荐算法帮你找到合适的押韵词语,打开灵感空间 智能曲谱 基于深度学习神经网络算法,为海量歌曲生成智能吉他曲谱,只需上传音乐,即可弹你想弹的歌

    y.qq.com/tme_studio - 2026-07-04 - 收藏
  • lalal.ai提取人声

    lalal.ai提取人声

    从任何音频中提取人声、伴奏和各种乐器 基于世界上最先进的人工智能技术的高质量音轨分离器

    www.lalal.ai - 2026-07-04 - 收藏
  • Buzz:离线开源免费语音转文字(字幕)

    Buzz:离线开源免费语音转文字(字幕)

    基于Whisper的GUI软件:Buzz:离线语音转文字(字幕) Buzz:离线开源免费语音转文字(字幕) Whisper 是什么? Whisper 是一种通用语音识别模型。它利用各种大型数据集上的音频进行训练,也是一个多任务模型,可以执行多语言语音识别以及语音翻译和语言识别。

    github.com/chidiwilliams/buzz - 2026-07-04 - 收藏
  • CapsWriter-Offline 语音输入 字幕转录工具

    CapsWriter-Offline 语音输入 字幕转录工具

    这是 CapsWriter-Offline ,一个 PC 端的语音输入、字幕转录工具。 CapsWriter-Offline 语音输入 字幕转录工具 两个功能: 按下键盘上的 大写锁定键,录音开始,当松开 大写锁定键 时,就会识别你的录音,并将识别结果立刻输入 将音视频文件拖动到客户端打开,即可转录生成 srt 字幕 视频教程:CapsWriter-Offline 电脑端离线语音输入工具 特性 完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔 热词功能:可以在 hot-en.txt hot-zh.txt hot-rule.txt 中添加三种热词,客户端动态载入 日记功能:默认每次录音识别后,识别结果记录在 年份/月份/日期.md ,录音文件保存在 年份/月份/assets 关键词日记:识别结果若以关键词开头,会被记录在 年份/月份/关键词-日期.md,关键词在 keywords.txt 中定义 转录功能:将音视频文件拖动到客户端打开,即可转录生成 srt 字幕 服务端、客户端分离,可以服务多台客户端 编辑 config.py ,可以配置服务端地址、快捷键、录音开关…… 懒人包 对 Windows 端: 请确保电脑上安装了 Microsoft Visual C++ Redistributable 运行库 服务端载入模型所用的 onnxruntime 只能在 Windows 10 及以上版本的系统使用 服务端载入模型需要系统内存 4G,只能在 64 位系统上使用 额外打包了 32 位系统可用的客户端,在 Windows 7 及以上版本的系统可用 模型文件较大,单独打包,解压模型后请放入软件目录的 models 文件夹中 其它系统: 其它系统,可以下载模型、安装依赖后从 Python 源码运行。 由于我没有 Mac 电脑,无法打包 Mac 版本,只能从源码运行,可能会有诸多问题要解决。(由于系统限制,客户端需要 sudo 启动,且默认快捷键为 right shift) 模型说明: 由于模型文件太大,为了方便更新,单独打包 解压模型后请放入软件目录的 models 文件夹中 下载地址: 百度盘: https://pan.baidu.com/s/1zNHstoWZDJVynCBz2yS9vg 提取码: eu4c GitHub Release: Releases · HaujetZhao/CapsWriter-Offline (百度网盘容易掉链接,补链接太麻烦了,我不一定会补链接。GitHub Releases 界面下载是最可靠的。)

    github.com/HaujetZhao/CapsWriter-Offline - 2026-07-04 - 收藏

推荐资讯

推荐站点

  • 造点造点

    核心功能与模型 “造点”平台的最大亮点是整合了业界顶尖的AI模型,实现了“强强联合”: 1. AI生视频:率先接入 通义万相 Wan2.5 全球首发/国内首个: 成为国内首个支持音画同步生成的平台。它可以在生成视频画面的同时,自动匹配人声、音效和背景音乐。 高质量输出: 支持生成长达10秒、1080P高清、24帧/秒的视频,画质可满足专业需求。 强指令遵循: 能够理解并执行复杂的指令,如运镜、视角切换等连续变化。 声音驱动: 用户可以在提示词中用引号(“”)来描述声音,实现声音驱动画面生成。 2. AI生图:集成 Midjourney V7与夸克图片1.0 顶级美学: 接入了Midjourney V7模型。 本土化优化与易用性: 无需魔法,中文友好: 国内用户可以直接使用Midjourney V7模型,无需海外网络环境。 UI简化: 将MJ复杂的参数(如风格化、怪异化)做成了直观的滑块控制,方便调节。 辅助功能: 提供“智能润色”和“特征词库”等功能,帮助新手快速上手。 特色能力: 结合夸克自研技术,夸克图片1.0模型在亚洲人像、中文文字生成、国风元素等方面表现出色,适合电商、设计等场景。 产品体验与工作流 一站式创作流: 用户可以在平台内使用Midjourney V7生成高质量图片后,一键调用通义万相Wan2.5将图片转化为动态视频,整个创作流程非常顺畅。 双端体验: PC网页端: 提供功能最全面的专业创作体验,面向专业创作者。 夸克APP移动端: 提供轻量化的创作体验,以对话式交互为主,满足普通用户的趣味玩法和日常修图需求,如“一句话P图”、换发型、换背景、风格转换等。 价格与优惠活动 会员定价: 标准会员: 48元/月,可生成约400张MJ图片。相比Midjourney官方订阅(约70元/月生成200张),价格近乎“腰斩”。 高级会员: 188元/月,可生成约1800张MJ图片。 还有免费套餐,登录可获取每日积分。 限时免费活动: 活动时间: 即日起至9月30日。 活动内容: 所有用户均可享受7天免费体验通义万相Wan2.5的视频生成功能。 综上所述,“造点”是夸克在AIGC领域推出的一个旗舰级产品,它通过集成中外最顶尖的AI模型(通义万相2.5 + Midjourney V7),并辅以出色的本土化优化和极具竞争力的价格,为从专业创作者到普通用户的广泛人群提供了一个强大且易用的一站式AI内容创作平台。

    create.qianwen.com
  • 百小应百小应

    百川智能发布最新一代基座大模型Baichuan 4,并推出成立之后的首款AI助手“百小应”。Baichuan 4相较Baichuan 3 在各项能力上均有极大提升,其中通用能力提升超过10%,数学和代码能力分别提升14%和9%,在国内权威大模型评测机构SuperCLUE的评测中,模型能力国内第一。此外,Baichuan 4还具备行业领先的多模态能力,在各大评测基准上表现优异,领先Gemini Pro、Claude3-sonnet等多模态模型。在Baichuan 4强大能力的基础上,百川智能将搜索技术与大模型深度融合,推出懂搜索、会提问的AI助手“百小应”。

    yi.baichuan-ai.com
  • 腾讯元宝腾讯元宝

    腾讯元宝是基于腾讯混元大模型的AI助手应用,集成AI搜索、AI总结、AI写作、AI绘画等能力,同时支持创意绘画生图,帮助用户在工作、学习和生活中提高效率。

    yuanbao.tencent.com