Black Forest Labs 以 Early Access 方式推出 FLUX 3 多模态基础模型,采用统一架构联合学习图像、视频和音频。该模型基于 Self-Flow 学习框架扩展,可在单次生成中输出最长 20 秒视频并附带原生音频,支持文生视频、图生视频、多镜头串联等任务。
查看原文:https://www.ithome.com/0/981/137.htm
来源:IT之家(RSS)
暂无数据
扫码关注
联系我们
回顶部
微信扫码分享
评论 ( 0 )