令人兴奋的 Dall-E3 即将到来

简介: 令人兴奋的 Dall-E3 即将到来

image.png

经过10个月左右的沉寂,OpenAI 终于即将要发布 Dall-E3,这是其 AI 图像生成器的最新版本。据说 Dall-E3 比 Dall-E2 有明显的改进升级,具有更多细微差别和细节。

Dall-E3 有什么新功能?

  • 更好的图像质量和一致性
  • Dall-E3 可以生成文本
  • Dall-E3 集成在 ChatGPT 中
  • Dall-E3 创建的图像版权归用户

据说目前的版本可供约 400 个用户使用,超越了 OpenAI 的先前模型以及公认的竞争对手,例如 Midjourney 或者 Stable Diffusion XL。

更好的图像质量和一致性

和 Dall-E2 相比,Dall-E3 有更好的图像质量和一致性。

为了更好地说明其差异,来看看下面的示例。两个图像使用相同的提示(提示还是以英文为主)。

Prompt: A paper craft art depicting a girl giving her cat a gentle hug. Both sit amidst potted plants, with the cat purring contentedly while the girl smiles. The scene is adorned with handcrafted paper flowers and leaves.

image.png

这个例子展示了 Dall-E3 理解和生成复杂概念的能力。除此之外,注意到右图中的女孩既没有微笑也没有拥抱猫。

Dall-E3 可以生成文本

另一个重要的更新是能够正确、清晰地拼写单词。例如,可以使用 Dall-E3 生成复古的旅行海报:

Prompt: A vintage travel poster for Venus in portrait orientation. The scene portrays the thick, yellowish clouds of Venus with a silhouette of a vintage rocket ship approaching. Mysterious shapes hint at mountains and valleys below the clouds. The bottom text reads, ‘Explore Venus: Beauty Behind the Mist’. The color scheme consists of golds, yellows, and soft oranges, evoking a sense of wonder.

image.png

这个实例 AI 根据海报风格选择其理解的字体和颜色以匹配海报的整体美感,这一点是其他人工智能工具无法做到的。

集成在 ChatGPT 中

从 2023 年 10 月开始,ChatGPT Plus 订阅者将能够在 ChatGPT 中本地使用  Dall-E3 。这意味着可以使用 ChatGPT 生成或完善  Dall-E3 的提示,只需询问想查看什么即可。

ChatGPT Plus 还允许访问最新的语言模型、GPT-4 和 ChatGPT 插件,有条件的可以开通尝试。

image.png

它将于今年秋天晚些时候在 OpenAI Labs 上推出。

图像版权归用户

使用 Dall-E3 创建的图像可供您使用、重印、出售或商品化。

根据内容政策和条款,您拥有使用 DALL·E 创建的图像,包括转载、销售和商品化的权利 - 无论图像是通过免费还是付费信用生成的。

比 MidJourney 好吗?

MidJourney AI 长期以来被认为是最好的 AI 图像生成器。然而,Dall-E3 生成的图像质量是相当的,这两种工具目前处于激烈的竞争之中。

下面来看一个示例,当然这个示例不能代表所有,每个工具对于不同用户的喜好程度是不一样的。

Prompt: A vibrant yellow banana-shaped couch sits in a cozy living room, its curve cradling a pile of colorful cushions. on the wooden floor, a patterned rug adds a touch of eclectic charm, and a potted plant sits in the corner, reaching towards the sunlight filtering through the window. 提示:舒适的客厅里摆放着一张充满活力的黄色香蕉形沙发,其曲线支撑着一堆色彩缤纷的靠垫。木地板上,有图案的地毯增添了一丝不拘一格的魅力,一盆盆栽坐落在角落里,迎向透过窗户的阳光。

image.png

从上面的结果来看,其实跟现实中的两个人类似,不同的理解而已,效果都相当惊人。

总结

Dall-E3 目前尚未公开,但其结果的早期效果令人印象深刻。如果事实证明它比 MidJourney 更好,相信很多人愿意取消MidJourney 订阅并在 ChatGPT 上使用 Dall-E3。

译自:medium.com/generative-…


相关文章
|
26天前
|
机器学习/深度学习 人工智能 并行计算
"震撼!CLIP模型:OpenAI的跨模态奇迹,让图像与文字共舞,解锁AI理解新纪元!"
【10月更文挑战第14天】CLIP是由OpenAI在2021年推出的一种图像和文本联合表示学习模型,通过对比学习方法预训练,能有效理解图像与文本的关系。该模型由图像编码器和文本编码器组成,分别处理图像和文本数据,通过共享向量空间实现信息融合。CLIP利用大规模图像-文本对数据集进行训练,能够实现zero-shot图像分类、文本-图像检索等多种任务,展现出强大的跨模态理解能力。
74 2
|
1月前
|
人工智能 自然语言处理 搜索推荐
Sora - 探索AI视频模型的无限可能
这篇文章详细介绍了Sora AI视频模型的技术特点、应用场景、未来展望以及伦理和用户体验等方面的问题。
26 0
|
6月前
|
机器学习/深度学习 人工智能
超越Sora极限,120秒超长AI视频模型诞生!
【5月更文挑战第1天】 StreamingT2V技术突破AI视频生成界限,实现120秒超长连贯视频,超越Sora等传统模型。采用自回归方法,结合短期记忆的条件注意模块和长期记忆的外观保持模块,保证内容连贯性和动态性。在实际应用中,展示出优秀的动态性、连贯性和图像质量,但仍有优化空间,如处理复杂场景变化和连续性问题。[链接](https://arxiv.org/abs/2403.14773)
87 3
|
6月前
|
人工智能 自然语言处理 小程序
OpenAI颠覆AI绘画!DALL·E 3与ChatGPT合作,细节展现令人震撼!
OpenAI颠覆AI绘画!DALL·E 3与ChatGPT合作,细节展现令人震撼!
|
6月前
|
机器学习/深度学习 人工智能
看看OpenAI(ChatGPT)怎么回答马斯克呼吁停止ai研究的?
看看OpenAI(ChatGPT)怎么回答马斯克呼吁停止ai研究的?
333 1
|
6月前
|
机器学习/深度学习 人工智能 自然语言处理
文生视频Sora模型发布,是否引爆AI芯片热潮
文生视频Sora模型发布,是否引爆AI芯片热潮
178 0
|
6月前
|
机器学习/深度学习 人工智能 自然语言处理
万字Gemini技术报告来啦 | Gemini这么强,GPT-4输的有点多,多模态超过人类专家
万字Gemini技术报告来啦 | Gemini这么强,GPT-4输的有点多,多模态超过人类专家
312 0
|
机器学习/深度学习 人工智能 算法
ChatGPT唤醒AI游戏?
ChatGPT唤醒AI游戏?
162 0
|
机器学习/深度学习 人工智能 算法
OpenAI CEO:巨型AI模型时代已结束,马斯克TruthGPT曝光
OpenAI CEO:巨型AI模型时代已结束,马斯克TruthGPT曝光
129 0
|
机器学习/深度学习 人工智能 API
GPT-4震撼发布:多模态大模型,直接升级ChatGPT、必应,开放API,游戏终结了?(2)
GPT-4震撼发布:多模态大模型,直接升级ChatGPT、必应,开放API,游戏终结了?
113 0