谷歌发布了Imagen 3,这一新的文本到图像生成模型在理解复杂提示、生成细节丰富的图像方面有显著提升,并且能够更好地执行提示命令。Imagen 3集成了数字水印工具SynthID,提高了生成内容的可识别性,并加强了对安全性和责任感的关注。Google计划进一步扩展Imagen 3的功能,将其引入Gemini应用、Google Workspace和Google Ads等产品中,以推动其AI技术在公司服务和硬件中的应用。

关键点

– 谷歌推出了Imagen 3,新的文本到图像生成模型,提供更好的细节与提示遵循能力。
– Imagen 3适用于从摄影写实到艺术和3D构图的广泛图像生成需求。
– 该模型集成了SynthID水印技术,可识别生成内容。
– 谷歌承诺在开发和部署Imagen 3时注重安全性和责任。
– Imagen 3使用了丰富的图像字幕训练,提升了细节捕捉能力。
– 谷歌计划将Imagen 3的功能融入Gemini应用和其他Google产品中。
– 竞争对手包括Elon Musk的Grok 2以及即将更新的MidJourney和Ideogram模型。

https://decrypt.co/245121/google-imagen-3-release-imagefx