头版Folia Daily Briefing
← 返回头版
人工智能

Flux 3多模态基础模型开放早期访问

Flux公司推出了新一代多模态基础模型FLUX 3,支持图像、视频和音频的联合学习与生成。该模型能够生成长达20秒的视频和音频内容,并可合成和编辑各种风格的图像,同时具备动作预测能力。

Flux公司推出了新一代多模态基础模型FLUX 3,支持图像、视频和音频的联合学习与生成[1]。该模型能够生成长达20秒的视频和音频内容[1],并可合成和编辑各种风格的图像[1],同时具备动作预测能力[1]。

在初步性能评估中,FLUX 3相比多个竞品表现突出。与Runway Gen-4.5对比中被优选77%[1],与Luma Ray 3.2对比中被优选93%[1],与Grok Imagine Video对比中被优选69%[1],与Kling v3 Pro对比中被优选60%[1]。

目前FLUX 3 Video已进入早期访问阶段[1],FLUX 3 Image将在随后数周开放早期访问[1]。Flux计划提供多种访问方式,包括API、私有权重访问和开源权重访问[1]。此外,该公司与mimic robotics合作开发了FLUX-mimic模型用于机器人学习应用[1]。


FLUX 3多模态基础模型视频生成图像生成物理AI

来源

  1. Hacker News · Flux 3