您好,欢迎来到 锐星AI网站导航官网 - 国内外1000+AI工具,发现好用AI,为你导航未来!
登录 / 注册 / 找回密码
全新的分类目录站点,点击去提交

“AI编程工具”网站目录

  • HivisionIDPhoto

    HivisionIDPhoto

    HivisionIDPhoto 旨在开发一种实用、系统性的证件照智能制作算法。 它利用一套完善的AI模型工作流程,实现对多种用户拍照场景的识别、抠图与证件照生成。 HivisionIDPhoto 可以做到: 轻量级抠图(纯离线,仅需 CPU 即可快速推理) 根据不同尺寸规格生成不同的标准证件照、六寸排版照 支持 纯离线 或 端云 推理 美颜 智能换正装(waiting) github:https://github.com/Zeyi-Lin/HivisionIDPhotos

    github.com/Zeyi-Lin/HivisionIDPhotos - 收藏
  • MiniCPM3-4B

    MiniCPM3-4B

    IT之家 9 月 6 日消息,面壁智能官方公众号昨日(9 月 5 日)发布博文,宣布推出开源 MiniCPM3-4B AI 模型,声称“端侧 ChatGPT 时刻到来”。 IT之家附上 MiniCPM 3.0 开源地址: MiniCPM3-4B 是 MiniCPM 系列的第三代产品,整体性能超过了 Phi-3.5-mini-Instruct 和 GPT-3.5-Turbo-0125,媲美多款 70 亿~90 亿参数的 AI 模型。 MiniCPM3-4B 目前已经上线 GitHub 与 huggingface 平台: https://github.com/OpenBMB/MiniCPM https://huggingface.co/openbmb/MiniCPM3-4B

    github.com/OpenBMB/MiniCPM - 收藏
  • LabelU 开源标注工具

    LabelU 开源标注工具

    1.产品介绍 一款轻量级开源标注工具,自由组合多样工具,无缝兼容多格式数据,同时支持载入预标注,加速数据标注效率 2.特色功能 LabelU 提供了多种标注工具和功能,支持图像、视频、音频标注。 · 图像类:多功能图像处理工具,涵盖 2D 框、语义分割、多段线、关键点等多种标注工具,协助完成图像的标识、注释和分析。 · 视频类:具备强大视频处理能力,可实现视频分割、视频分类、视频信息提取等功能,为模型训练提供优质标注数据。 · 音频类:高效精准的音频分析工具,可实现音频分割、音频分类、音频信息提取等功能,将复杂的声音信息直观可视化。 3.产品特性 · 简易,提供多种图像标注工具,通过简单可视化配置即可标注 · 灵活,多种工具可自由组合使用,满足大部分图像,视频,音频的标注需求 · 通用,支持导出多种数据格式,包括 JSON,COCO,MASK

    github.com/opendatalab/labelU - 收藏
  • ModelScope-Agent

    ModelScope-Agent

    Modelscope-Agent 是一个可自定义且可扩展的代理框架。单个代理具有角色扮演、LLM 调用、工具使用、计划和记忆等功能。 它主要具有以下特点: 简单的代理实现过程:只需指定角色指令、LLM 名称和工具名称列表即可实现代理应用程序。该框架会自动安排工具使用、规划和内存的工作流。 丰富的模型和工具:框架配备了丰富的LLM接口,如Dashscope和Modelscope模型接口、OpenAI模型接口等,内置丰富的工具,如代码解释器、天气查询、文本转图、网页浏览等,让定制专属代理变得容易。 统一接口,高扩展性:框架具有清晰的工具和LLM注册机制,方便用户扩展更多样化的Agent应用。 低耦合:开发人员可以轻松使用内置工具、LLM、内存和其他组件,而无需绑定更高级别的代理。 ModelScope-Agent框架的设计具有以下特点: 可定制且功能全面的框架:提供可定制的引擎设计,涵盖了数据收集、工具检索、工具注册、存储管理、定制模型训练和实际应用等功能,可用于快速实现实际场景中的应用。 开源LLMs作为核心组件:支持在ModelScope社区的多个开源LLMs上进行模型训练,并开放了大规模中英文工具指令微调数据集。 多样化且全面的API:以统一的方式实现AI模型API和常见功能API的无缝集成,并通过调用魔搭社区上开源的文本向量模型,打造API工具检索引擎,直接根据用户指令检索相关的工具,更便捷易用。 开源地址:https://github.com/modelscope/modelscope-agent 体验网址:https://modelscope.cn/studios/iic/ModelScopeGPT/summary

    modelscope.cn/studios/iic/ModelScopeGPT/summary - 收藏
  • FunClip自动化视频剪辑工具

    FunClip自动化视频剪辑工具

    FunClip是一款完全开源、本地部署的自动化视频剪辑工具,通过调用阿里巴巴通义实验室开源的FunASR Paraformer系列模型进行视频的语音识别,随后用户可以自由选择识别结果中的文本片段或说话人,点击裁剪按钮即可获取对应片段的视频(快速体验)。 在上述基本功能的基础上,FunClip有以下特色: FunClip集成了阿里巴巴开源的工业级模型Paraformer-Large,是当前识别效果最优的开源中文ASR模型之一,Modelscope下载量1300w+次,并且能够一体化的准确预测时间戳。 FunClip集成了SeACo-Paraformer的热词定制化功能,在ASR过程中可以指定一些实体词、人名等作为热词,提升识别效果。 FunClip集成了CAM++说话人识别模型,用户可以将自动识别出的说话人ID作为裁剪目标,将某一说话人的段落裁剪出来。 通过Gradio交互实现上述功能,安装简单使用方便,并且可以在服务端搭建服务通过浏览器使用。 FunClip支持多段自由剪辑,并且会自动返回全视频SRT字幕、目标段落SRT字幕,使用简单方便。 欢迎体验使用,欢迎提出关于字幕生成或语音识别的需求与宝贵建议~ GitHub项目地址:https://github.com/alibaba-damo-academy/FunClip 在线体验地址:https://modelscope.cn/studios/iic/funasr_app_clipvideo/summary

    modelscope.cn/studios/iic/funasr_app_clipvideo/summary - 收藏
  • WhisperDesktop 本地音频转文字软件

    WhisperDesktop 本地音频转文字软件

    可实现本地电脑的音频转文字软件!完全免费开源!支持 Windows、macOS、Linux (目前界面只有英文的,但支持中文的转换) 特征 基于 DirectCompute 的供应商不可知的 GPGPU;该技术的另一个名称是“Direct3D 11 中的计算着色器” 纯 C++ 实现,除了基本的 OS 组件外没有运行时依赖性 比 OpenAI 的实现快得多。 混合 F16 / F32 精度:自 D3D 版本 10.0 起,Windows [color=var(–color-accent-fg)]需要缓冲区 的支持R16_FLOAT 内置性能分析器,可测量单个计算着色器的执行时间 内存使用率低 用于音频处理的媒体基础,支持大多数音频和视频格式(Ogg Vorbis 除外),以及大多数在 Windows 上运行的音频捕获设备(除了一些专业的,它们只实现 ASIO API [color=var(–color-accent-fg)]。 用于音频捕获的语音活动检测。 使用步骤: 下载 WhisperDesktop.zip、ggml-medium 语音模型(官方那里有好多规格如图一,作者推荐1.42G这个模型,下面百度云盘下载链接)解压WhisperDesktop.zip,打开WhisperDesktop.exe,首先选择要加载的语音模型

    github.com/chidiwilliams/buzz - 收藏
  • IOPaint

    IOPaint

    IOPaint 是一款免费、开源且完全可自行托管的修复/修复工具,由最先进的 AI 模型提供支持。 您可以在 IOPaint 中使用各种模型来更改图像,包括修改,例如: 擦除:删除任何不需要的对象、缺陷、水印、人物。还有一个名为 OptiClean 的 macOS 本机应用程序 提供此功能。 修复:修改图像的特定部分、添加新对象或替换图片上的任何内容。 Outpainting:在图像周围生成新像素以使其更大。 使用网址:https://www.iopaint.com/ 开源网址:https://github.com/Sanster/IOPaint

    www.iopaint.com - 收藏
  • Lepton Search

    Lepton Search

    Lepton Search是由贾扬清创办的Lepton AI应用构建平台开源的一个对话式AI搜素引擎,该项目基于调用llm人工智能模型和Bing搜索的API密钥,仅用不到 500 行 Python 代码就构建了一个类似于Perplexity AI的对话搜索引擎。 Lepton Search特征 对 LLM 的内置支持 内置搜索引擎支持 可定制漂亮的UI界面 可共享的缓存搜索结果 设置搜索引擎 API 有两个默认支持的搜索引擎:Bing 和 Google。 必应搜索 要使用 Bing Web Search API,请访问此链接以获取您的 Bing 订阅密钥。 谷歌搜索 您可以使用三种 Google 搜索选项:您可以使用SearchApi 中的SearchApi Google 搜索 API 、 Serper 中的Serper Google 搜索 API ,或者选择Google 提供的可编程搜索引擎。 开源网址:https://github.com/leptonai/search_with_lepton

    search.lepton.run - 收藏
  • FastGPT

    FastGPT

    FastGPT 是一个基于 LLM 构建的基于知识的平台,提供了一整套开箱即用的功能,例如数据处理、RAG 检索和可视化 AI 工作流编排,让您轻松开发和部署复杂的问答系统,而无需进行大量设置或配置。 FastGPT 官方文档:https://doc.fastgpt.in/docs/ 国际版:tryfastgpt.ai

    fastgpt.cn - 收藏
  • FunASR 基础语音识别工具包

    FunASR 基础语音识别工具包

    FunASR希望在语音识别的学术研究和工业应用之间架起一座桥梁。 通过发布工业级语音识别模型的训练和微调,研究人员和开发人员可以更方便地进行语音识别模型的研究和生产,并推动语音识别生态的发展。 让语音识别更有趣! 目前可以用cpu来部署,实测准确率还可以

    www.funasr.com - 收藏
共 197 条«12345678»

📰 推荐资讯

⭐ 推荐站点

  • 造点
    造点

    核心功能与模型 “造点”平台的最大亮点是整合了业界顶尖的AI模型,实现了“强强联合”: 1. AI生视频:率先接入 通义万相 Wan2.5 全球首发/国内首个: 成为国内首个支持音画同步生成的平台。它可以在生成视频画面的同时,自动匹配人声、音效和背景音乐。 高质量输出: 支持生成长达10秒、1080P高清、24帧/秒的视频,画质可满足专业需求。 强指令遵循: 能够理解并执行复杂的指令,如运镜、视角切换等连续变化。 声音驱动: 用户可以在提示词中用引号(“”)来描述声音,实现声音驱动画面生成。 2. AI生图:集成 Midjourney V7与夸克图片1.0 顶级美学: 接入了Midjourney V7模型。 本土化优化与易用性: 无需魔法,中文友好: 国内用户可以直接使用Midjourney V7模型,无需海外网络环境。 UI简化: 将MJ复杂的参数(如风格化、怪异化)做成了直观的滑块控制,方便调节。 辅助功能: 提供“智能润色”和“特征词库”等功能,帮助新手快速上手。 特色能力: 结合夸克自研技术,夸克图片1.0模型在亚洲人像、中文文字生成、国风元素等方面表现出色,适合电商、设计等场景。 产品体验与工作流 一站式创作流: 用户可以在平台内使用Midjourney V7生成高质量图片后,一键调用通义万相Wan2.5将图片转化为动态视频,整个创作流程非常顺畅。 双端体验: PC网页端: 提供功能最全面的专业创作体验,面向专业创作者。 夸克APP移动端: 提供轻量化的创作体验,以对话式交互为主,满足普通用户的趣味玩法和日常修图需求,如“一句话P图”、换发型、换背景、风格转换等。 价格与优惠活动 会员定价: 标准会员: 48元/月,可生成约400张MJ图片。相比Midjourney官方订阅(约70元/月生成200张),价格近乎“腰斩”。 高级会员: 188元/月,可生成约1800张MJ图片。 还有免费套餐,登录可获取每日积分。 限时免费活动: 活动时间: 即日起至9月30日。 活动内容: 所有用户均可享受7天免费体验通义万相Wan2.5的视频生成功能。 综上所述,“造点”是夸克在AIGC领域推出的一个旗舰级产品,它通过集成中外最顶尖的AI模型(通义万相2.5 + Midjourney V7),并辅以出色的本土化优化和极具竞争力的价格,为从专业创作者到普通用户的广泛人群提供了一个强大且易用的一站式AI内容创作平台。

    create.qianwen.com
  • 百小应
    百小应

    百川智能发布最新一代基座大模型Baichuan 4,并推出成立之后的首款AI助手“百小应”。Baichuan 4相较Baichuan 3 在各项能力上均有极大提升,其中通用能力提升超过10%,数学和代码能力分别提升14%和9%,在国内权威大模型评测机构SuperCLUE的评测中,模型能力国内第一。此外,Baichuan 4还具备行业领先的多模态能力,在各大评测基准上表现优异,领先Gemini Pro、Claude3-sonnet等多模态模型。在Baichuan 4强大能力的基础上,百川智能将搜索技术与大模型深度融合,推出懂搜索、会提问的AI助手“百小应”。

    yi.baichuan-ai.com
  • 腾讯元宝
    腾讯元宝

    腾讯元宝是基于腾讯混元大模型的AI助手应用,集成AI搜索、AI总结、AI写作、AI绘画等能力,同时支持创意绘画生图,帮助用户在工作、学习和生活中提高效率。

    yuanbao.tencent.com