您好,欢迎来到 锐星AI网站导航官网 - 国内外1000+AI工具,发现好用AI,为你导航未来!
登录 / 注册 / 找回密码
全新的分类目录站点,点击去提交

“AI编程工具”网站目录

  • PhotoMaker

    PhotoMaker

    PhotoMaker简介 PhotoMaker,利用多张照片作为身份ID,获取人物特征,然后根据描述生成符合描述的人物照片创造出一个新的、个性化的人物图像。 PhotoMaker也能把几个不同人的照片特征混合在一起,创造出一个全新的人物形象。还能改变照片人物的性别、年龄和生成多种风格的其他照片。快速逼真,效果自然。

    photo-maker.github.io - 收藏
  • DDColor

    DDColor

    图像上色(Image Colorization)是一项经典的计算机视觉任务,在许多现实世界的应用中具有巨大的潜力,例如老照片修复、电影重制和艺术创作等。给定一个灰度图像,图像上色旨在恢复其缺失的两个颜色通道,这个问题具有多模态不确定性,因为一个物体可能有多个似是而非的颜色。因此,图像上色一直是一个具有挑战性的问题。 随着 DDColor 的推出,图像着色领域见证了变革性的飞跃,这是一种使用双解码器的新方法。DDColor 是魔搭大模型最新的图像上色算法,输入一张黑白图像,返回上色处理后的彩色图像,并能够实现自然生动的上色效果。 DDColor 由阿里巴巴集团达摩院的 Xiaoyang Kang、Tao Yang、Wenqi Ouyang、Peiran 任、Lingzhi Li 和 Xuansong Xie 开发,在产生逼真的色彩方面脱颖而出,尤其是在具有多个对象和不同上下文的复杂场景中。 DDColor使用双解码器技术,能够同时考虑色彩分布和像素级详细信息,能实现高度真实的图像上色效果。 DDColor 不仅能给历史黑白照片上色,还能对动漫或游戏中的风景进行真实风格的上色。将动画场景转化为现实生活风格。

    github.com/piddnad/DDColor - 收藏
  • LibreChat

    LibreChat

    LibreChat,一个增强版的ChatGPT程序,一个免费开源的聊天机器人平台,集成了多种 ai 模型,例如 ChatGPT、OpenAI、BingAI、PaLM 2 等。 LibreChat 允许您与不同的 AI 进行自然且引人入胜的对话,并使用各种功能和插件定制您的体验。LibreChat还集成并增强了原始客户端功能,例如对话和消息搜索、提示模板和插件。 项目地址:https://github.com/danny-avila/LibreChat

    www.librechat.ai - 收藏
  • QAnything

    QAnything

    什么是QAnything? QAnything (Question and Answer based on Anything) 是致力于支持任意格式文件或数据库的本地知识库问答系统,可断网安装使用。 您的任何格式的本地文件都可以往里扔,即可获得准确、快速、靠谱的问答体验。 目前已支持格式: PDF,Word(doc/docx),PPT,Markdown,Eml,TXT,图片(jpg,png等),网页链接,更多格式,敬请期待… 特点 数据安全,支持全程拔网线安装使用。 支持跨语种问答,中英文问答随意切换,无所谓文件是什么语种。 支持海量数据问答,两阶段向量排序,解决了大规模数据检索退化的问题,数据越多,效果越好。 高性能生产级系统,可直接部署企业应用。 易用性,无需繁琐的配置,一键安装部署,拿来就用。 支持选择多知识库问答。 QAnything官网:https://qanything.ai/ 开源GitHub:https://github.com/netease-youdao/QAnything

    qanything.ai - 收藏
  • ChatGPT-Next-Web-LangChain

    ChatGPT-Next-Web-LangChain

    网址:https://github.com/Hk-Gosuto/ChatGPT-Next-Web-LangChain 一键免费部署你的跨平台私人 ChatGPT 应用, 支持 GPT3, GPT4 & Gemini Pro 模型。 (基于 LangChain 实现插件功能)

    github.com/Hk-Gosuto/ChatGPT-Next-Web-LangChain - 收藏
  • 视频翻译配音

    视频翻译配音

    一个免费开源用于编辑和配音视频字幕的工具。用户在生成字幕后,可以轻松地修改它们,并重新生成配音。该工具提供了多种由edgeTTS提供的配音角色,并支持openai的TTS模型配音。此外,它还集成了google、chatGPT、DeepL、Baidu、DeepLX、Gemini和tencent等多种语音识别和翻译工具,以提供全面的服务。除了视频翻译和配音工具,该网站还提供了其他相关的开源项目,如声音克隆工具、语音识别工具和人声背景乐分离工具等。

    pyvideotrans.com - 收藏
  • HierVST

    HierVST

    HierVST 是一种分层自适应零样本语音风格转换模型,它具备以下功能特点: 零样本语音风格转换:HierVST 可以在没有目标说话者语音数据的情况下,将一个新的说话者的语音风格转换为目标风格。这意味着即使没有目标说话者的语音样本,HierVST 也可以生成具有目标风格的语音。 分层自适应结构:HierVST 使用分层自适应生成器,逐步生成音高表示和波形音频,从而实现逐步转换语音的能力。这种结构让模型能够适应新的语音风格,并逐步进行转换。 自监督表示学习:HierVST 仅使用语音数据集进行训练,而无需使用文本转录。它采用了层次变分推断和自监督表示学习的方法,提高了模型在音频表示上的性能。 性能优于其他模型:在零样本语音风格转换场景中,HierVST 的实验结果表明其性能优于其他 VST 模型,如 AutoVC、VoiceMixer、DiffVC、Speech Resynthesis 和 YourTTS。

    hiervst.github.io - 收藏
  • InsightFace

    InsightFace

    InsightFace是一个开源的2D和3D深度人脸分析库。 功能特点: 面部识别:InsightFace实现了最先进的面部识别算法,可以高效准确地进行人脸识别。它在CVPR 2019上被接受为最先进的面部识别方法。 面部检测:该库提供了RetinaFace,这是一种最先进的多任务面部检测方法。它在CVPR 2020上被接受,并能在复杂场景下实现高准确率的面部检测。 面部对齐:InsightFace提供了SDUNet和CoordinateReg等面部对齐方法。这些算法能够对面部进行准确的对齐,保证了后续处理的准确性。 易于使用和部署:InsightFace是一个易于使用的Python库,提供了方便的API接口,使得研究机构和商业组织可以轻松地使用和部署该库中的算法。 开源:InsightFace是开源的,用户可以自由地查看和修改源代码,以满足自己的需求。 强大的性能:InsightFace在多个面部分析挑战中取得了优异的成绩,包括在ECCV 2022 WCPA Challenge中获得第一名,在NIST-FRVT 1:1 VISA中获得第一名,在NIST-FRVT 1:1中排名第四。

    www.insightface.ai - 收藏
  • Wunjo

    Wunjo

    CoDeF通过将静态内容与时间变形结合,为视频处理提供了新的视角和工具。这种方法能够提高视频编辑和分析的效率,并具有潜力影响电影制作到虚拟现实等领域。CoDeF将视频分为规范内容字段和时间变形字段,能够精确分析和处理每一帧的内容。它还可以跟踪和分析视频中的复杂运动,实现卓越的跨帧一致性。CoDeF具有灵活性和高效性,可以应用于多种视频处理任务。 该项目由蚂蚁集团、香港科技大学和浙江大学团队共同创建。

    wladradchenko.ru/#products - 收藏
  • ComfyUI Portrait Master

    ComfyUI Portrait Master

    ComfyUI Portrait Master 肖像大师 简体中文版是一款专业的人物肖像提示词生成工具。它专注于优化肖像生成,让选择比填空更适合人类的操作方式。这款工具可以根据用户的具体需求,生成各种肖像的提示词,覆盖镜头类型、性别、国籍、面部表情、发型等多个参数。用户可以根据自己的需求进行个性化设置,例如调整发型、表情等。此外,此工具适用于多种工作流程,广泛应用于视频制作和设计等领域。目前最新版本为2.2,经过优化和汉化处理,ComfyUI Portrait Master项目为使用者提供了更加便捷的使用体验。如果你对此感兴趣,可以到项目官网学习使用方法,网上也有详细的教程可供参考。 使用参考:https://zhuanlan.zhihu.com/p/663008600

    github.com/ZHO-ZHO-ZHO/comfyui-portrait-master-zh-cn - 收藏
共 197 条«12345678»

📰 推荐资讯

⭐ 推荐站点

  • 造点
    造点

    核心功能与模型 “造点”平台的最大亮点是整合了业界顶尖的AI模型,实现了“强强联合”: 1. AI生视频:率先接入 通义万相 Wan2.5 全球首发/国内首个: 成为国内首个支持音画同步生成的平台。它可以在生成视频画面的同时,自动匹配人声、音效和背景音乐。 高质量输出: 支持生成长达10秒、1080P高清、24帧/秒的视频,画质可满足专业需求。 强指令遵循: 能够理解并执行复杂的指令,如运镜、视角切换等连续变化。 声音驱动: 用户可以在提示词中用引号(“”)来描述声音,实现声音驱动画面生成。 2. AI生图:集成 Midjourney V7与夸克图片1.0 顶级美学: 接入了Midjourney V7模型。 本土化优化与易用性: 无需魔法,中文友好: 国内用户可以直接使用Midjourney V7模型,无需海外网络环境。 UI简化: 将MJ复杂的参数(如风格化、怪异化)做成了直观的滑块控制,方便调节。 辅助功能: 提供“智能润色”和“特征词库”等功能,帮助新手快速上手。 特色能力: 结合夸克自研技术,夸克图片1.0模型在亚洲人像、中文文字生成、国风元素等方面表现出色,适合电商、设计等场景。 产品体验与工作流 一站式创作流: 用户可以在平台内使用Midjourney V7生成高质量图片后,一键调用通义万相Wan2.5将图片转化为动态视频,整个创作流程非常顺畅。 双端体验: PC网页端: 提供功能最全面的专业创作体验,面向专业创作者。 夸克APP移动端: 提供轻量化的创作体验,以对话式交互为主,满足普通用户的趣味玩法和日常修图需求,如“一句话P图”、换发型、换背景、风格转换等。 价格与优惠活动 会员定价: 标准会员: 48元/月,可生成约400张MJ图片。相比Midjourney官方订阅(约70元/月生成200张),价格近乎“腰斩”。 高级会员: 188元/月,可生成约1800张MJ图片。 还有免费套餐,登录可获取每日积分。 限时免费活动: 活动时间: 即日起至9月30日。 活动内容: 所有用户均可享受7天免费体验通义万相Wan2.5的视频生成功能。 综上所述,“造点”是夸克在AIGC领域推出的一个旗舰级产品,它通过集成中外最顶尖的AI模型(通义万相2.5 + Midjourney V7),并辅以出色的本土化优化和极具竞争力的价格,为从专业创作者到普通用户的广泛人群提供了一个强大且易用的一站式AI内容创作平台。

    create.qianwen.com
  • 百小应
    百小应

    百川智能发布最新一代基座大模型Baichuan 4,并推出成立之后的首款AI助手“百小应”。Baichuan 4相较Baichuan 3 在各项能力上均有极大提升,其中通用能力提升超过10%,数学和代码能力分别提升14%和9%,在国内权威大模型评测机构SuperCLUE的评测中,模型能力国内第一。此外,Baichuan 4还具备行业领先的多模态能力,在各大评测基准上表现优异,领先Gemini Pro、Claude3-sonnet等多模态模型。在Baichuan 4强大能力的基础上,百川智能将搜索技术与大模型深度融合,推出懂搜索、会提问的AI助手“百小应”。

    yi.baichuan-ai.com
  • 腾讯元宝
    腾讯元宝

    腾讯元宝是基于腾讯混元大模型的AI助手应用,集成AI搜索、AI总结、AI写作、AI绘画等能力,同时支持创意绘画生图,帮助用户在工作、学习和生活中提高效率。

    yuanbao.tencent.com