Hasty Briefsbeta

双语

Flux 3

9 hours ago
  • FLUX 3 是一种新型多模态基础模型,在统一架构中联合学习图像、视频和音频,旨在学习真实世界的表征。
  • 该模型基于这样的原则:没有单一模态能提供完整描述;相反,多种模态提供了相互约束,揭示了潜在的现实。
  • FLUX 3 能够生成和编辑图像、带音频的视频,并支持文本到视频、图像到视频、视频到视频、多语言对话和动作预测等功能。
  • 初步评估表明,FLUX 3 在视频生成方面优于其他几种模型,相对于某些竞争对手,偏好度高达93%。
  • 发布计划包括通过API提供FLUX 3、私有权重访问,以及最终为多模态骨干网络提供开放权重访问。
  • 未来目标包括将感知、动作和语言预测统一到一个模型中。