今日,人工智能初创公司 Luma AI 正式推出了其划时代的视觉大模型 —— Uni-1。这不仅是 Luma 的首个统一理解与生成模型,
Luma 团队表示:“Uni-1 更加智能、更具可控性,且富有文化底蕴。它能精准捕捉复杂的指令,在镜头角度、光影构图以及艺术风格上展现出前所未有的灵活性。”
在同步发布的各项基准测试中,Uni-1 展现出了挑战行业霸主(如 DeepMind、OpenAI等)的强劲实力:
- ODinW 稠密检测精度: Uni-1 完整版的 mAP 评分达到 46.2,远超 Qwen3-VL-Thinking(43.2),紧追 Gemini 3 Pro。
- RISEBench 综合表现: 在因果推理(Causal)、空间感知(Spatial)和逻辑推理(Logical)等维度,Uni-1 展现了极强的统治力,综合得分(0.51)领先于 GPT Image 1.5 和 Nano Banana 系列。
- 人类偏好(Elo): 在人类评测中,Uni-1 在整体表现、文本转图像、风格编辑等领域均位列第一梯队,尤其在风格迁移和参考图生成方面,其 Elo 评分高达 1078。
Luma 官方指出,Uni-1 在以下四大领域被视为“同类最佳(Best-in-class)”:
- 电影级图像生成: 极致的光影表现力。
- 漫画与网漫创作: 深刻理解二次元叙事逻辑。
- 风格迁移与参考: 极高保真度的风格延续。
- 新视角合成(Novel View Synthesis): 强大的空间想象力。
为了推动开发者生态建设,Luma 公布了详细的 API 定价方案。Uni-1 采用基于 Token 的计费模式(API目前还没公开)
面对 Deepmind、OpenAI等行业巨头的竞争,Luma 团队表现出了极大的信心。团队负责人表示:“能够构建出这样一个世界级的模型,我们感到无比自豪。这只是一个开始,后续我们将陆续发布 API、技术报告和模型卡片(Model Card)。”







