6 月 26 日消息,谷歌推出了其最新版本的文本生成图像模型 Imagen 4,并推出了高端版本 Imagen 4 Ultra。与前代产品 Imagen 3 相比,此次更新旨在显著提升文本渲染效果。目前,这两个版本已上线 Gemini API 的付费预览版,并在 Google AI Studio 提供有限的免费测试。

谷歌将 Imagen 4 定位为“适用于大多数任务”的通用模型,每张图像为定价 0.04 美元(注:现汇率约合 0.29 元人民币)。而 Imagen 4 Ultra 则被设计为能够更精准地遵循文本提示词的高端版本,其价格较普通版高出 50%,每张图像收费 0.06 美元(现汇率约合 0.43 元人民币)。谷歌声称,与 Dall-E 和 Midjourney 等其他图像生成器相比,Imagen 4 Ultra 的输出结果更为“出色(strong)”。
尽管 Imagen 4 在性能上较前代有所提升,但其表现并未让人眼前一亮,尤其是在与市场领导者 Dall-E 3 和 Midjourney 7 相比时。此外,在最初的热情过后,公众对 AI 艺术的兴趣似乎正在消退,其主要应用场景似乎变成了社交媒体上的垃圾广告。