GPT-4o生图能力炸场,可以做空Adobe了? | 胡扯 AI
北京时间3月26日凌晨,OpenAI 发布了 GPT-4o 图像生成能力,官方描述为:
- 精准文本渲染
- 严格指令遵循
- 深度知识调用
- 创意拓展能力
看完下面的提示词和图片,曾老师感慨:
- 一次大模型的更新,就能改变 AI 世界的工作流。不敢不学,又不能乱学,等等党最终会胜利吗?
- 再过1、2个月,国内厂商跟进之后,复杂的 ComfyUI 工作流是否会产生变化?
- 基于精准控制能力,Agent 和图像精细控制能爆发出怎样的生产力?
回想起 1999 年抱着一本打印 Photoshop5 教材背诵快捷键的日子,突然发现已经过去了二十多个年头……
画一个肯德基的简体中文菜单,其中有一个套餐叫做“V 我 50”
画一张4个漫画,推理悬疑漫画封面,大字”黑夜疑云”,对话气泡侦探:“你说他昨晚不在场?这可疑点重重“,烘托紧张气氛
右下角那格加一句台词:“我昨晚跟她媳妇在一起不会被发现了吧”
制作一张漫画风格的生日卡,上面写着“我希望你今天像动漫开场中的超新星一样闪耀!"
曾老师:即梦 AI 也能做类似的图,可以去看看。
An infographic explaining newton's prism experiment in great detail 一张详细解释牛顿棱镜实验的信息
Now generate a POV of a person drawing this diagram in their notebook, at a round cafe table in washington square park 现在生成一个人在华盛顿广场公园圆形咖啡馆的桌子上,在笔记本上绘制此图的PO
创建一个包含所有元素的周期表卡通图像。确保每个元素框都标有元素的全名(如氦或氢)。在每个元素的框中,包含一个代表该元素的卡通图像。同时也包括一些完全随机的物品,而不是实际的元素,仿佛是在幻觉中看到周期表的成员。
—张用手机拍摄的宽幅图像,显示一个玻璃白板,位于俯瞰海湾大桥的房间里。视野中可以看到一位穿着印有大型 OpenAI标志的T恤的女性正在书写。字迹看起来自然且有些凌乱,我们可以看到摄影师的倒影。 摄影师的自拍视角,她转身与他击掌
奥特曼打小怪兽
修改图片,要求,移除图中的所有人,100%保留所有街景和店铺实景
concrete poem on luxury eggshell textured card 把下面这个内容,放在蛋壳纹理的卡片上
show this card, but in a designers room. card close to the camera 在设计师的房间里展示这张卡片,卡片靠近相机
指令遵循:只有一滴红酒的空玻璃杯
这是魔兽世界的新种族(橘猫族),请把这只猫放到角色选择界面,16:9 画面,其他文字信息你自己看着补充
对这只橘猫,来一个无背景的透明 png
今天情绪非常低落,压力非常大,我不清楚我现在做什么,是从现在开始到将来都还有价值的。 比如GPT-40的图像能力,直接干翻了之前很多创业公司的产品,他们花了那么多时间、人力、投资人的钱去调优的算法、工作流、模型,直接被一次大模型的更新就取代了。 昨天还在看SD 教程,今天发现白看了…
Jimmy Cheung@remixdesigner
图像来源:
- https://www.huxiu.com/article/4164831.html
- https://www.53ai.com/news/MultimodalLargeModel/2025032667513.html
- https://news.qq.com/rain/a/20250326A07FM600
- 胡扯游戏群/胡扯AI群
- 文章ID:2972
- 原文作者:zrong(Jacky)
- 原文链接:https://blog.zengrong.net/post/gpt-4o-image-generation/
- 【公众号】曾嵘胡扯的地方:https://mp.weixin.qq.com/s/l1wuRbu4AXyCdgwRCYszsg
- 版权声明:本作品采用 署名-非商业性使用-相同方式共享 4.0 国际 (CC BY-NC-SA 4.0) 进行许可,非商业转载请注明出处(原文作者,原文链接),商业转载请联系作者获得授权。