图像生成与编辑
根据文本提示生成和编辑图像,包括定价页中展示的文生图和图像修改工作流。
Uni-1 是 Luma 的多模态推理模型,用于生成像素。产品页将其定位为建立在“Unified Intelligence”之上的系统,能够理解意图、响应指令,并将推理与视觉生成结合起来。
技术报告将 Uni-1 描述为 Luma 的首个统一理解与生成模型,旨在将推理和想象力整合到单一架构中。它以交错序列同时处理文本和图像,并被呈现为一种可以在视觉任务中进行规划、迭代和执行的模型。
Luma 网站将 UNI-1 置于实际图像工作流之中,例如文生图、图像编辑、参考引导创作和文化感知风格化。定价页面将 UNI-1 列在图像生成定价下,API 页面则将其与视频模型一起作为多模型创意工作流的一部分。
根据文本提示生成和编辑图像,包括定价页中展示的文生图和图像修改工作流。
使用参考输入来在输出中保留身份、构图和其他视觉约束,如展示页和技术规格中所示。
支持多参考生成,适用于多个源图像共同定义结果的场景,包括单图和多图工作流。
在渲染图像之前,对场景补全、空间关系和基于合理性的变换应用结构化推理。
适配不同美学与视觉语言,包括展示页中强调的文化感知生成、漫画、表情包及其他风格变体。
作为 Luma API 产品的一部分提供 UNI-1,并为图像生成提供单独的 API 访问流程和定价。
当你需要一个能够推理场景结构、合理性和构图,而不仅仅是匹配关键词的模型时,可根据文字提示创建图像。
在保留重要视觉参考(如身份、布局或其他源图细节)的同时修改现有图像。
当单一参考不足以定义期望结果时,可利用多张源图生成变体。
在保持主体和构图可识别的同时,探索不同的视觉风格或文化美学。
通过 API 构建由 Luma 支持的创意流水线,包括将 UNI-1 用于图像、将 Ray3.2 用于视频的工作流。
UNI-1 是 Luma 的多模态推理模型,用于生成和编辑图像。该网站将其突出展示为适用于文生图、图像修改和参考引导工作流的模型。
产品页指出,UNI-1 可用于图像生成、图像编辑和多参考生成。展示页和技术页面强调了参考引导式创作、文化/风格变化,以及结构化视觉推理。
Luma 将 UNI-1 描述为一个将推理与视觉想象结合在一起的统一模型。其技术报告称,它可以在图像合成之前和过程中对指令进行规划和推理;首页则表示它建立在 Unified Intelligence 之上。
网站显示,UNI-1 可通过 Luma 的产品站点和 API 访问流程使用,并为早期 API 访问提供等待名单。定价页面则单独列出了图像生成的价格。
产品页面将 UNI-1 定位为更广泛的 Luma 工作流中的一部分,API 页面提到可将 UNI-1 用于图像生成,并与 Ray3.2 配合用于视频生成的多模型工作流。
AakarDev AI 帮助团队在一个仪表板中管理 AI provider 访问、项目级设置、日志和分析,支持 BYOK 工作流,并涵盖 OpenAI、Google Gemini、Anthropic、Groq、Mistral AI 和 Perplexity AI。
BookAI允许您通过简单提供书名和作者与您的书籍进行AI聊天。
Skills Janitor 是一组托管于 GitHub 的斜杠命令,用于审计、跟踪和管理 Claude Code 与 OpenAI Codex skills。可查找重复项、损坏链接和未使用的 skills,并用独立命令清理。
FeelFish 是一款面向 AI 辅助小说写作的 PC 客户端,帮助小说作者规划人物与场景、撰写和修改长篇内容,并管理故事上下文。支持免费版和付费方案,兼容多种大模型服务商。
Benchspan 是一款 AI agent 安全平台,可发现 agent、实时阻止提示注入和数据外泄,并支持上线前红队测试,适用于生产环境中的 agent 团队,提供 Python 和 TypeScript SDK。
ChatBA 是一款生成式 AI 工具,可根据提示词快速生成演示文稿。支持即时生成幻灯片,并提供模板、分享和数据源帮助内容。