您好,欢迎来到 锐星AI网站导航官网 - 国内外1000+AI工具,发现好用AI,为你导航未来!
登录 / 注册 / 找回密码
全新的分类目录站点,点击去提交

  • DeepSeek

    DeepSeek

    DeepSeek是幻方量化旗下的人工智能公司深度求索自主研发的开源大模型和AI智能助手,专注于通用人工智能(AGI)底层模型与技术的研发,探索AGI的实现路径。DeepSeek推出了多个开源大语言模型,如DeepSeek-V3和DeepSeek-R1,分别对标GPT-4o和OpenAI的o1模型。模型在推理、数学和编程能力方面表现出色,训练成本远低于行业平均水平。应用广泛,涵盖智能对话、文本生成、语义理解、代码生成等多个领域,支持联网搜索、深度思考等功能。

    www.deepseek.com/?ref=ruix.cn - 2026-07-06 - 收藏
  • Janus Pro 统一多模态理解与生成模型

    Janus Pro 统一多模态理解与生成模型

    Janus-Pro是什么 Janus 是由 DeepSeek 团队开发的一系列统一多模态理解与生成模型,旨在通过解耦视觉编码来实现多模态任务的高效处理。Janus-Pro 是 Janus 的升级版本,进一步优化了训练策略、扩充了训练数据集,并扩大了模型规模,从而在多模态理解和文本到图像生成能力上取得了显著提升。 Janus-Pro的功能 多模态理解:Janus 和 Janus-Pro 能够处理多种多模态任务,包括图像描述、表格和图表理解等。通过将视觉编码解耦为独立的通道,模型能够更有效地提取图像中的高维语义特征,并将其映射到语言模型的输入空间中,从而实现对复杂多模态数据的理解。 文本到图像生成:Janus 和 Janus-Pro 具备根据文本描述生成图像的能力。模型通过将文本和图像特征序列整合为统一的多模态特征序列,输入大语言模型进行处理,从而生成与文本描述相符的图像。Janus-Pro 在此方面进行了优化,引入了大量合成美学数据样本,显著提升了生成图像的稳定性和美学质量。 指令遵循与对话能力:通过监督微调,Janus 和 Janus-Pro 能够更好地遵循用户指令,并在对话场景中提供准确的回答。模型在多模态理解和生成任务中均表现出色,能够处理各种复杂的输入和任务需求。 Janus-Pro的技术原理 视觉编码解耦:Janus 和 Janus-Pro 采用独立的视觉编码路径,分别用于多模态理解和生成任务。这种解耦方式缓解了视觉编码器在理解和生成任务中的角色冲突,提高了模型的灵活性和可扩展性。例如,在多模态理解中使用 SigLIP 编码器提取高维语义特征,而在视觉生成中使用 VQ 分词器将图像转换为离散 ID 序列。 自回归框架:整个模型基于自回归框架,使用统一的 Transformer 架构进行处理。模型通过内置的预测头进行文本预测,同时引入随机初始化的预测头用于图像预测。这种设计使得模型能够在多模态任务中保持一致性和高效性。 训练策略优化:Janus-Pro 对训练策略进行了优化,包括增加第一阶段的训练步数、在第二阶段中直接使用标准文本生图数据进行训练,以及调整第三阶段监督微调过程中的数据配比。这些改进提高了模型的训练效率和整体性能。 数据扩充与模型扩展:Janus-Pro 显著扩充了训练数据集,包括多模态理解数据和视觉生成数据。同时,模型规模从 1B 参数扩展到 7B 参数,进一步提升了模型的表达能力和性能。 Janus-Pro的项目地址 Janus GitHub 仓库:https://github.com/deepseek-ai/Janus Janus-Pro 技术报告:https://github.com/deepseek-ai/Janus/blob/main/janus_pro_tech_report.pdf HuggingFace模型库: 模型(7B):https://huggingface.co/deepseek-ai/Janus-Pro-7B 模型(1B):https://huggingface.co/deepseek-ai/Janus-Pro-1B 在线体验Demo:https://huggingface.co/spaces/deepseek-ai/Janus-Pro-7B 参考链接: 腾讯云开发者社区文章:https://cloud.tencent.com/developer/article/2493369 澎湃新闻报道:https://www.thepaper.cn/newsDetail_forward_30053423 github:https://github.com/deepseek-ai/Janus

    github.com/deepseek-ai/Janus - 2026-07-05 - 收藏
  • 问小白: 探索世界的AI搭子

    问小白: 探索世界的AI搭子

    问小白 - 主动型AI助手,探索世界的AI搭子。顶级大模型免费使用,Deepseek R1/V3/V3.1、问小白5对标Openai-GPT5,支持AI联网搜索、AI学术搜索,Deep Research,AI图片编辑和生成,AI 智能体情感陪伴

    www.wenxiaobai.com - 2026-07-01 - 收藏
  • DeepSeek | 深度求索

    DeepSeek | 深度求索

    深度求索(DeepSeek),成立于2023年,专注于研究世界领先的通用人工智能底层模型与技术,挑战人工智能前沿性难题。基于自研训练框架、自建智算集群和万卡算力等资源,深度求索团队仅用半年时间便已发布并开源多个百亿级参数大模型,如DeepSeek-LLM通用大语言模型、DeepSeek-Coder代码大模型,并在2024年1月率先开源国内首个MoE大模型(DeepSeek-MoE),各大模型在公开评测榜单及真实样本外的泛化效果均有超越同级别模型的出色表现。和 DeepSeek AI 对话,轻松接入 API。

    www.deepseek.com - 2026-06-27 - 收藏
  • 问小白-DeepSeek-R1满血版

    问小白-DeepSeek-R1满血版

    免费不限次数,深度思考和联网搜索。问小白「DeepSeek-R1 671B 满血版」主打一个不卡、零延迟、不限次、而且可以一直免费用,不卡不限频次网页版/app均可使用

    www.wenxiaobai.com - 2026-06-27 - 收藏
共 5 条1

推荐资讯

推荐站点

  • 造点造点

    核心功能与模型 “造点”平台的最大亮点是整合了业界顶尖的AI模型,实现了“强强联合”: 1. AI生视频:率先接入 通义万相 Wan2.5 全球首发/国内首个: 成为国内首个支持音画同步生成的平台。它可以在生成视频画面的同时,自动匹配人声、音效和背景音乐。 高质量输出: 支持生成长达10秒、1080P高清、24帧/秒的视频,画质可满足专业需求。 强指令遵循: 能够理解并执行复杂的指令,如运镜、视角切换等连续变化。 声音驱动: 用户可以在提示词中用引号(“”)来描述声音,实现声音驱动画面生成。 2. AI生图:集成 Midjourney V7与夸克图片1.0 顶级美学: 接入了Midjourney V7模型。 本土化优化与易用性: 无需魔法,中文友好: 国内用户可以直接使用Midjourney V7模型,无需海外网络环境。 UI简化: 将MJ复杂的参数(如风格化、怪异化)做成了直观的滑块控制,方便调节。 辅助功能: 提供“智能润色”和“特征词库”等功能,帮助新手快速上手。 特色能力: 结合夸克自研技术,夸克图片1.0模型在亚洲人像、中文文字生成、国风元素等方面表现出色,适合电商、设计等场景。 产品体验与工作流 一站式创作流: 用户可以在平台内使用Midjourney V7生成高质量图片后,一键调用通义万相Wan2.5将图片转化为动态视频,整个创作流程非常顺畅。 双端体验: PC网页端: 提供功能最全面的专业创作体验,面向专业创作者。 夸克APP移动端: 提供轻量化的创作体验,以对话式交互为主,满足普通用户的趣味玩法和日常修图需求,如“一句话P图”、换发型、换背景、风格转换等。 价格与优惠活动 会员定价: 标准会员: 48元/月,可生成约400张MJ图片。相比Midjourney官方订阅(约70元/月生成200张),价格近乎“腰斩”。 高级会员: 188元/月,可生成约1800张MJ图片。 还有免费套餐,登录可获取每日积分。 限时免费活动: 活动时间: 即日起至9月30日。 活动内容: 所有用户均可享受7天免费体验通义万相Wan2.5的视频生成功能。 综上所述,“造点”是夸克在AIGC领域推出的一个旗舰级产品,它通过集成中外最顶尖的AI模型(通义万相2.5 + Midjourney V7),并辅以出色的本土化优化和极具竞争力的价格,为从专业创作者到普通用户的广泛人群提供了一个强大且易用的一站式AI内容创作平台。

    create.qianwen.com
  • 百小应百小应

    百川智能发布最新一代基座大模型Baichuan 4,并推出成立之后的首款AI助手“百小应”。Baichuan 4相较Baichuan 3 在各项能力上均有极大提升,其中通用能力提升超过10%,数学和代码能力分别提升14%和9%,在国内权威大模型评测机构SuperCLUE的评测中,模型能力国内第一。此外,Baichuan 4还具备行业领先的多模态能力,在各大评测基准上表现优异,领先Gemini Pro、Claude3-sonnet等多模态模型。在Baichuan 4强大能力的基础上,百川智能将搜索技术与大模型深度融合,推出懂搜索、会提问的AI助手“百小应”。

    yi.baichuan-ai.com
  • 腾讯元宝腾讯元宝

    腾讯元宝是基于腾讯混元大模型的AI助手应用,集成AI搜索、AI总结、AI写作、AI绘画等能力,同时支持创意绘画生图,帮助用户在工作、学习和生活中提高效率。

    yuanbao.tencent.com