UNI-1 icon

UNI-1

UNI-1 是 Luma 的多模态推理模型,用于生成和编辑图像。支持文生图、参考引导和基于 API 的工作流,适合创作者和开发者构建视觉内容。

UNI-1

概述

Uni-1 是 Luma 的多模态推理模型,用于生成像素。产品页将其定位为建立在“Unified Intelligence”之上的系统,能够理解意图、响应指令,并将推理与视觉生成结合起来。

技术报告将 Uni-1 描述为 Luma 的首个统一理解与生成模型,旨在将推理和想象力整合到单一架构中。它以交错序列同时处理文本和图像,并被呈现为一种可以在视觉任务中进行规划、迭代和执行的模型。

Luma 网站将 UNI-1 置于实际图像工作流之中,例如文生图、图像编辑、参考引导创作和文化感知风格化。定价页面将 UNI-1 列在图像生成定价下,API 页面则将其与视频模型一起作为多模型创意工作流的一部分。

核心能力

图像生成与编辑

根据文本提示生成和编辑图像,包括定价页中展示的文生图和图像修改工作流。

参考引导创作

使用参考输入来在输出中保留身份、构图和其他视觉约束,如展示页和技术规格中所示。

多图条件控制

支持多参考生成,适用于多个源图像共同定义结果的场景,包括单图和多图工作流。

推理驱动输出

在渲染图像之前,对场景补全、空间关系和基于合理性的变换应用结构化推理。

风格与文化变化

适配不同美学与视觉语言,包括展示页中强调的文化感知生成、漫画、表情包及其他风格变体。

API 就绪工作流

作为 Luma API 产品的一部分提供 UNI-1,并为图像生成提供单独的 API 访问流程和定价。

常见工作流

  • 文生图生成

    当你需要一个能够推理场景结构、合理性和构图,而不仅仅是匹配关键词的模型时,可根据文字提示创建图像。

  • 参考引导编辑

    在保留重要视觉参考(如身份、布局或其他源图细节)的同时修改现有图像。

  • 多参考概念设计

    当单一参考不足以定义期望结果时,可利用多张源图生成变体。

  • 风格探索

    在保持主体和构图可识别的同时,探索不同的视觉风格或文化美学。

  • 开发者工作流

    通过 API 构建由 Luma 支持的创意流水线,包括将 UNI-1 用于图像、将 Ray3.2 用于视频的工作流。

Pros and Cons

Pros

  • 将推理与图像生成结合在单一模型中。
  • 支持参考引导和多参考视觉工作流。
  • 同时覆盖生成和编辑两类用例。
  • 支持跨多种视觉语言和美学的风格变化。
  • 可通过 Luma 的产品界面和 API 访问流程使用。

Cons

  • 网站除产品页和 API 页之外,对支持的集成和运行限制公开细节较少。
  • 定价以 token 和积分为单位展示,若要估算单个项目成本,可能需要更仔细地了解 Luma 的计费模型。
  • 公开页面并未完整列出所有工作流的技术限制、输出格式或安全护栏。

FAQ

什么是 Uni-1?

UNI-1 是 Luma 的多模态推理模型,用于生成和编辑图像。该网站将其突出展示为适用于文生图、图像修改和参考引导工作流的模型。

我可以用 UNI-1 做什么?

产品页指出,UNI-1 可用于图像生成、图像编辑和多参考生成。展示页和技术页面强调了参考引导式创作、文化/风格变化,以及结构化视觉推理。

UNI-1 与标准图像模型有何不同?

Luma 将 UNI-1 描述为一个将推理与视觉想象结合在一起的统一模型。其技术报告称,它可以在图像合成之前和过程中对指令进行规划和推理;首页则表示它建立在 Unified Intelligence 之上。

UNI-1 是否可通过 API 使用?

网站显示,UNI-1 可通过 Luma 的产品站点和 API 访问流程使用,并为早期 API 访问提供等待名单。定价页面则单独列出了图像生成的价格。

UNI-1 在 Luma 更广泛的平台中扮演什么角色?

产品页面将 UNI-1 定位为更广泛的 Luma 工作流中的一部分,API 页面提到可将 UNI-1 用于图像生成,并与 Ray3.2 配合用于视频生成的多模型工作流。

Quick Facts

类别
AI 图像生成
平台
Luma 网页产品和 API
主要用户
构建图像工作流的创作者、团队和开发者
来源域名
lumalabs.ai
相关工作流
与 Ray3.2 搭配用于多模型创意工作流
定价模式
在 Luma 的定价页中列出,采用基于积分/token 的图像定价