DALL-E 3 开放部分内测,多了一个开 GPT Plus 的理由

OpenAI 前几天发布了 DALL-E 的升级版本,可以与 ChatGPT 集成,从而改进提示词的使用。
这是一项重要的进展,因为现在大多数先进的 AI 图像生成工具都可以根据提示词(图像描述)创建各种艺术风格的图像,从写实照片到奇幻图像。然而,编写准确的提示词可能是一项挑战,因此"prompt engineering 提示工程师"这个职业正在变得越来越受欢迎。
与此同时,DALL-E 3 带来了许多其他重要的新功能。OpenAI 表示,DALL-E 3 能够生成更高质量的图像,更准确地反映提示词,尤其是在处理较长的提示词时表现更出色。
目前,DALL-E 3 正处于研究预览阶段,计划在 10 月份通过 API 发布,供 ChatGPT Plus 用户和企业客户使用。此后,OpenAI 计划在今年秋季尽可能让大家都能用到此功能。一个显著的功能是 DALL-E 3 能够合成和处理文本,在 OpenAI 的博客示例图中已经展示了:

DALL·E 3 限量测试,已由微软 Bing 抢先开启了!


没收到资格也没关系,再加上第三方研究预览、OpenAI 员工的内部试玩,各种测试案例纷纷涌现,包看过瘾。
最夸张的一个,要数 Reddit 上有人建议让 DALL-E 3**“指定画面中出现50个不同物体”**,结果足足画出了几百个。


收到研究预览版的第三方设计师 Nathan Shipley 接下了这个挑战。
首先他先让 ChatGPT 随机列出 50 个日常物体,然后直接要求把这些物体都画在一幅画里就可以了。完整的提示词是 ChatGPT 自己补全,再由 DALL·E 3 画出来。

一张照片中,一位皮肤被阳光亲吻过的中年波利尼西亚男性冲浪者,奋力冲浪,手里拿着一大堆压倒性的 50 件物品,包括茶杯、自行车、雨伞、烛台、口琴、地球仪、笔记本、羽毛、秒表、棋盘、弹珠、围巾、灯笼、画笔、凉鞋、指南针、双筒望远镜、扳手、花瓶、溜溜球、鹅毛笔、水壶、书包、贝壳、挂坠盒、铅笔、日晷、卷尺、算盘、袖扣、保龄球球、口哨、镘刀、抹刀、沙漏、大礼帽、长笛、显微镜、拼图游戏、放大镜、飞盘、陀螺、手电筒、跳绳、开罐器、风铃、盆景树、擀面杖、热水瓶和打字机。海浪在他周围拍打,他的表情充满决心和轻微的恐慌,试图平衡物体和他的冲浪板。


后来 Nathan 又提出换一个更低的视角的要求,这回 ChatGPT 把提示词中的人物描述换成了“一张从靠近水面的低视角拍摄的照片,一名西班牙老年妇女冲浪经过。冲浪者与一大堆 50 个物体奋力搏斗......”。

虽然我们没法自己体验 DALL-E 3,但是 Logan.GPT 发了帖子,可以把提示词发送给他,帮我们来画。

https://x.com/OfficialLoganK/status/1704850313889595399?s=20
Wormhole singularity with code flowing into the event horizon, futuristic and awe inspiring.
虫洞奇点,代码流入事件视界,充满未来感,令人惊叹。

Photorealistic, hyper-detailed image of a hippopotamus sitting confidently on a Vespa scooter, wearing black leather hand shoes. The iconic Eiffel Tower serves as a majestic backdrop, with tourists visibly taken aback by the unique spectacle.
河马穿着黑色皮鞋,自信地坐在 Vespa 踏板车上,逼真、超详细的图像。标志性的埃菲尔铁塔作为雄伟的背景,游客们显然会被这种独特的奇观所震惊。

A hackathon set in a forest with teams of humans, animals, plants and IoT sensor tech visible and working in collaboration
一场以森林为背景的黑客马拉松,由人类、动物、植物和物联网传感器技术组成的团队可见并协同工作

A group of free-spirited hippies sit atop the VW 1960 beetle van, marveling at the breathtaking view of the Northern Lights above, captured with a 16-35mm f/2.8 lens to capture the expansive sky and foreground elements with a wide-angle view, set at an aspect ratio of 3:2 to highlight the natural beauty, while using a high ISO of 3200 to capture the magical display of lights, and a shutter speed of 20 seconds to capture the movement of the Northern Lights in the sky, creating a dreamy and otherworldly atmosphere, one of the hippies wears a blue hoodie with “no more” text on it
一群自由奔放的嬉皮士坐在大众 1960 甲壳虫面包车上,惊叹于上方北极光的壮丽景色,使用 16-35mm f/2.8 镜头以广角视角捕捉广阔的天空和前景元素,设置3:2的长宽比来突出自然美景,同时使用3200的高ISO来捕捉灯光的神奇展示,以及20秒的快门速度来捕捉北极光在天空中的移动,其中一位嬉皮士穿着一件蓝色连帽衫,上面写着“不再”字样,营造出一种梦幻般的超凡脱俗的氛围

Here's a tough one, by ChatGPT (3.5): A group of squirrels engaged in a heated debate over the best strategy to outsmart a cleverly placed nut dispenser, resembling a miniature United Nations assembly. One squirrel passionately argues for diplomacy, another for acorn taxes, and a third for forming alliances with rival chipmunks – all while wearing comically tiny suits and gesticulating wildly.
这是 ChatGPT (3.5) 提出的一个难题: 一群松鼠就如何智胜一个巧妙放置的坚果分配器(类似于微型联合国大会)的最佳策略展开了激烈的辩论。一只松鼠热情地主张外交,另一只松鼠主张橡子税,第三只松鼠则主张与竞争对手的花栗鼠结成联盟——所有这一切都穿着滑稽的小西装,疯狂地打着手势。


A medieval fantasy landscape, rolling green fields with a bright blue sky filled with puffy white clouds. On top of one of the clouds is a castle rising from it. A knight races across the field.
中世纪的奇幻风景,连绵起伏的绿色田野,明亮的蓝天上飘着蓬松的白云。在其中一朵云的顶部,一座城堡从云中拔地而起。一位骑士在球场上奔跑。

Two onions talking to eachother, with speech bubbles above them. The first onion asks a question, which the second onion responds with a pun.
两个洋葱互相交谈,上面有对话气泡。第一个洋葱问一个问题,第二个洋葱用双关语回答。

I friend gave me one, and most of AIs struggle with it, “A horse drinking water from water bottle”
我的朋友给了我一个,大多数人工智能都在挣扎,“一匹马从水瓶里喝水”

“a giant ladybug looking disapprovingly at a mini elephant“
“一只巨大的瓢虫不满地看着一头迷你大象”

大象做错了什么???
Adventurers preparing to go through orange glowing magical portal in a great desert, dof, realistic, isometric
冒险家准备在大沙漠中穿过橙色发光的魔法门户,自由度,现实,等距

还有很多,就不一一列举了,更多作品可以去作者原推下面看。
OpenAI 负责 ChatGPT 企业版的 Adam Goldberg 也晒出不少高质量结果,不过没有分享提示词。



虽然 10 月份 DALL·E 3 在 ChatGPT Plus 要收费每月 20 美元。
但既然 GPT-4 在 Bing 上是免费提供的,将来DALL·E 3免费玩也可以期待一波了~
参考链接:
[1]https://x.com/OfficialLoganK/status/1704850313889595399?s=20
[2]https://x.com/CitizenPlain/status/1705248617131291032?s=20
[3]https://x.com/CitizenPlain/status/1705248617131291032
[4]https://www.reddit.com/r/StableDiffusion/comments/16owoss/dalle_3_screen_capture_more_info_in_comments/k1p7aav/?context=3
一本《写给设计师看的专用单词表》送给坚持看完的你!
这里有一个非常实用的 AI 出图风格单词表,PDF全文共 134 页。
这个单词表能够帮助你更好地理解和应用不同的出图风格,从而让你的 AI 作品更加漂亮和独特。
因为 AI 出图效果与所选的风格词汇密切相关,只要你掌握了这些关键词汇,你就能够轻松地创作出令人印象深刻的图像。


