“AI编程工具”网站目录
-
RVM
RVM 专为稳定人物视频抠像设计。不同于现有神经网络将每一帧作为单独图片处理,RVM 使用循环神经网络,在处理视频流时有时间记忆。RVM 可在任意视频上做实时高清抠像。在 Nvidia GTX 1080Ti 上实现 4K 76FPS 和 HD 104FPS。此研究项目来自字节跳动。
github.com/PeterL1n/RobustVideoMatting - 收藏 -
openai-translator
基于Chatgpt自主开发的翻译软件,支持翻译、输出、润色、分析和代码批注,可以在github上下载客户端使用
github.com/nextai-translator/nextai-translator - 收藏 -
privateGPT
基于私有LLM(大语言模型)做个人的文档问答,不必担心隐私泄露 技术栈是 LangChain 和 GPT4All – LLM默认用的 ggml-model-q4_0.bin. – Embedding默认用的是 ggml-model-q4_0.bin 当然你可以自己替换,不过对中文支持应该不会太好。
github.com/zylon-ai/private-gpt - 收藏 -
-
ChatALL
一款应用程序,一次提问向多个大模型AI机器人聊天(包括ChatGPT,bing,Bard,文心,讯飞,360 智脑等)
github.com/ai-shifu/ChatALL/releases - 收藏 -
Quivr
Quivr是一款使用生成AI技术来存储和检索非结构化信息的“第二大脑”。以下是Quivr的一些功能特点: 本地应用:Quivr是一款纯本地应用程序,无需联网即可使用,安全。 智能化搜索和存储:Quivr使用AI技术进行搜索和存储,可以更快捷、准确地检索和存储信息。 语法高亮:Quivr支持语法高亮,让文本编辑和阅读更加舒适。 黑暗模式:Quivr提供黑暗模式,允许用户在夜间或低光环境下使用更舒适。 源文件保存:Quivr支持源文件保存,以便在需要时导出、共享或修改。 国际化:Quivr具有多国语言支持,为全球用户提供了更好的体验。 演示功能:Quivr还提供了演示功能,用户可以在其中创建易于阅读的幻灯片,展示他们的思维过程和见解。
github.com/QuivrHQ/quivr - 收藏 -
IP Adapter
IP Adapter 是腾讯AI实验室推出的 AI 绘图模型,效果类似 ControlNet,可以控制图片生成的效果。即将支持了 SDXL。
ip-adapter.github.io - 收藏 -
Look Scanned(仿真扫描)
一个纯前端网站,使PDF文件的外观看起来像是扫描件。 功能点: 1. 无需打印扫描:你不再需要将纸质文件打印出来,然后再进行扫描。只需使用鼠标点击几下,即可完成仿真扫描。 2. 隐私保护:所有数据在你自己的浏览器中处理,不会离开你的设备,因此不存在隐私泄露的风险。 3. 快速操作:利用先进的WebAssembly等技术,免去了繁琐的打印和扫描过程。只需点击按钮,即可迅速生成所需的仿真扫描文件。 4. 个性化调整:你可以根据需要调整参数,使生成的扫描文件看起来更加真实。同时,还可以实时预览扫描文件,所见即所得。 5. 开源项目:Look Scanned是开源的,你可以在GitHub上获取其源代码。该项目的灵感也来自另一个开源项目baicunko/scanyourpdf。 6. 跨平台使用:Look Scanned不仅可在计算机上使用,还可以在手机上使用。它能在所有现代浏览器上正常运行。 7. 无需网络连接:即使没有网络,Look Scanned也可以运行。不需要等待漫长的上传过程,也不受网络速度的限制。
zh.lookscanned.io - 收藏 -
wav2lip
通过语音和人脸图像来生成逼真的嘴唇运动 功能特点: 语音到嘴唇生成:Wav2Lip利用先进的深度学习算法,能够根据给定的语音输入和人脸图像,生成非常逼真的嘴唇运动。这种技术可以应用在许多领域,如电影制作、虚拟角色和动画等。 在野外环境中实现:Wav2Lip是为了在野外环境下实现语音到嘴唇生成而设计的。这意味着它能够识别和生成逼真的嘴唇运动,即使在复杂的背景和光照条件下也能取得良好的效果。 基于深度学习:Wav2Lip基于深度学习技术,在训练过程中使用了大量的语音和人脸图像数据,使得其能够学习到语音和嘴唇之间的复杂关系,从而实现准确和逼真的嘴唇生成。 可扩展性:由于Wav2Lip是一个开源项目,它具有很高的可扩展性。通过对算法和模型的改进,它可以在未来更好地满足用户的需求,并应用于更多的应用场景。
github.com/Rudrabha/Wav2Lip - 收藏 -
📰 推荐资讯
⭐ 推荐站点
-
造点
核心功能与模型 “造点”平台的最大亮点是整合了业界顶尖的AI模型,实现了“强强联合”: 1. AI生视频:率先接入 通义万相 Wan2.5 全球首发/国内首个: 成为国内首个支持音画同步生成的平台。它可以在生成视频画面的同时,自动匹配人声、音效和背景音乐。 高质量输出: 支持生成长达10秒、1080P高清、24帧/秒的视频,画质可满足专业需求。 强指令遵循: 能够理解并执行复杂的指令,如运镜、视角切换等连续变化。 声音驱动: 用户可以在提示词中用引号(“”)来描述声音,实现声音驱动画面生成。 2. AI生图:集成 Midjourney V7与夸克图片1.0 顶级美学: 接入了Midjourney V7模型。 本土化优化与易用性: 无需魔法,中文友好: 国内用户可以直接使用Midjourney V7模型,无需海外网络环境。 UI简化: 将MJ复杂的参数(如风格化、怪异化)做成了直观的滑块控制,方便调节。 辅助功能: 提供“智能润色”和“特征词库”等功能,帮助新手快速上手。 特色能力: 结合夸克自研技术,夸克图片1.0模型在亚洲人像、中文文字生成、国风元素等方面表现出色,适合电商、设计等场景。 产品体验与工作流 一站式创作流: 用户可以在平台内使用Midjourney V7生成高质量图片后,一键调用通义万相Wan2.5将图片转化为动态视频,整个创作流程非常顺畅。 双端体验: PC网页端: 提供功能最全面的专业创作体验,面向专业创作者。 夸克APP移动端: 提供轻量化的创作体验,以对话式交互为主,满足普通用户的趣味玩法和日常修图需求,如“一句话P图”、换发型、换背景、风格转换等。 价格与优惠活动 会员定价: 标准会员: 48元/月,可生成约400张MJ图片。相比Midjourney官方订阅(约70元/月生成200张),价格近乎“腰斩”。 高级会员: 188元/月,可生成约1800张MJ图片。 还有免费套餐,登录可获取每日积分。 限时免费活动: 活动时间: 即日起至9月30日。 活动内容: 所有用户均可享受7天免费体验通义万相Wan2.5的视频生成功能。 综上所述,“造点”是夸克在AIGC领域推出的一个旗舰级产品,它通过集成中外最顶尖的AI模型(通义万相2.5 + Midjourney V7),并辅以出色的本土化优化和极具竞争力的价格,为从专业创作者到普通用户的广泛人群提供了一个强大且易用的一站式AI内容创作平台。
create.qianwen.com -
百小应
百川智能发布最新一代基座大模型Baichuan 4,并推出成立之后的首款AI助手“百小应”。Baichuan 4相较Baichuan 3 在各项能力上均有极大提升,其中通用能力提升超过10%,数学和代码能力分别提升14%和9%,在国内权威大模型评测机构SuperCLUE的评测中,模型能力国内第一。此外,Baichuan 4还具备行业领先的多模态能力,在各大评测基准上表现优异,领先Gemini Pro、Claude3-sonnet等多模态模型。在Baichuan 4强大能力的基础上,百川智能将搜索技术与大模型深度融合,推出懂搜索、会提问的AI助手“百小应”。
yi.baichuan-ai.com -
腾讯元宝
腾讯元宝是基于腾讯混元大模型的AI助手应用,集成AI搜索、AI总结、AI写作、AI绘画等能力,同时支持创意绘画生图,帮助用户在工作、学习和生活中提高效率。
yuanbao.tencent.com