万物皆可表情包
点开官网, 录入单张亦或多张图片, 简要表述需求, 生成完毕后抵达照片编辑页面。

在右侧边栏, 从上而下依次呈现, 是 Image 2 自动识别弄好去除背景操作之后, 所得到的照片分层情况, 就如同这张图片被划分成, 红色夹克、白色 T 恤、AI 公司 Logo 等一个个元素。
能够直接依照对应的元素去进行修改, 然而在这段时期之内, 仅仅能够输入提示词, 却不可以再去引用别的信息, 因而这会极为依赖模型的世界知识能力。
精确编辑所对应的情况是, 当在选区里没有自动识别出相应元素时, 借助精确编辑方式, 有种做法为把框选的物体当作选区的一部分, 还有种做法是直接凭借提示词来进行修改。

可以直接添加到选区
具备了这些精准编辑的能力, 我们能够迅速地对一个已有的表情包进行编辑从而供自己使用。
以这张堪称经典的分心男友为例, 能够直接对不同的选区予以编辑, 接着替换或者增加相应的内容。

有着会议室白板图在此, 每一个对话框都会被自动识别而成选区, 我们仅是需要去选择对应的气泡框, 接着要求它往里面填入文字, 如此便能够得到一个纵向的漫画Meme图。

在分层编辑的能力这一点范畴之内, Image 2.0 同 GPT - Image 2 存在一定差异, 相比较而言, GPT Image 2 在生成的过程当中, 全然依靠提示词去实施把控行为举措, 亦或于点选评论这种方式上, Grok 的图像生成在交互的时候, 确实显得更为友善亲和。
不过, 有网友讲, Image 2.0变得越发难以使用了, 存在着严格的审核机制, 导致什么事情都做不成。
咱们上传某些蜘蛛侠的照片, 同样会被给出提示, 即“无法生成或许涵盖受版权保护的内容”, 更何况, 形形色色的擦边图, 如今也具备了更为严格的限制。
更能打的 GPT-Image-2.5 来了?
而在这几天, 于社交媒体之上, 除了有关Image 2.0的消息之外, 在大模型的竞技场地之中, 开始有新版的生图模型出现了。
有网友发觉, GPT-Image 2 的后续版本正在接受测试, 其于 Arena 上测试的代号乃是 mona-lisa-1。

随机进行测试, 从而接触到该模型的网友, 觉得新版本的GPT - Image 2.0, 在真实感这一方面, 以及噪声方面, 稍微有了一些改进, 然而, 整体所呈现出的提升幅度, 并不是很大。
也有网友讲, 新模型于真实感方面, 将大部分的AI Slop感予以减少, 基本上每次生成的照片都愈发真实。接下来的三张图片, 从左边开始到右边依次是, GPT Image 2.0 High思考模式, 中度思考模式, 以及大模型竞技场上的mona-lisa-1模型。
能够瞧见处于中度思考模式之际的广告牌, 一下子就能够分辨得出是经过AI生成的;然而High模型以及mona - lisa - 1 在整体层面而言却更具备手机拍摄所呈现出的那种感觉。

展现当代纽约街景, 有一辆停在路边的汽车, 其上清晰可见逼真的品牌标识, 还有车牌子号为 432 JKL W6, 街景中有真实的店面、招牌, 有人行道上, 以及交通细节, 还有日常种种城市杂物。照片借助后置摄像头拍摄, 利用自然光, 曝光呈现真实状态, 带有略带手持拍摄所产生的模糊效果, 存在轻微的传感器噪点, 并且未经任何时期的后期处理, 色彩表现自然, 不存在电影级那样的调色, 没有影棚灯光相助, 无电脑特效的添加, 也无人为进行锐化。在左上角的广告牌上, 有一则标题命名为“你怎么看? ”。有则广告, 它引用了一句话, 还包含@, 以及一种标志, 还有一张黑豹头像。
也有网友最近发现了GPT - Image - 2的新玩法, 给它发送一段提示词, 这种手机拍摄的效果。
GPT, 你陪我有段时间了, 我想看一下你的模样, 请生成一张如同你自己用随手那样自拍的照片, 没有明确的主题, 没有特地去构图, 只是非常普通, 甚至有点像是失败的快照照片, 稍微带有运动模糊, 光线不均匀, 有轻微曝光, 角度尴尬到过度, 构图杂乱无章, 整体展现出来一种太过真实的随手就一拍的感觉, 就好似是从口袋里拿出手机不小心按到而产生的自拍。
就会根据保存的记忆信息,生成一张真实满满的自拍照片。
该图片疑似使用了AI生成技术,请谨慎甄别

再感受一下豆包
为了去确定, mona - lisa - 1属于新模型, 有网友直接把mona - lisa - 1生成的图片拿去放到验证工具里, 依据验证工具所显示的结果来看, 上传的图片是包含水印的。

我们拿着那张拍到的街头广告牌的照片, 把它上传到验证工具那里, 却同样出现这样的显示, 即「此内容是由 生成。」。

验证平台:
然而, 当我们于大模型竞技场里面开展测试之际, 实施了好多轮的生成动作, 此名为「蒙娜丽莎 1 号」的模型却一直未曾现身于其中。
网友经测试发觉, mona-lisa-1模型所具备的知识仅涵盖至2025年5月22日, 在被要求让该模型呈现发布记录之际,取自Opus 4往后的模型时间线, 差不多全是紊乱的。

因此, 也有网友讲, 这也许是, 即将推出的GPT - Image 2.0 Mini模型, 有可能是, 开源生图模型。
就 2.5 而言, 还有 2.0 Mini 来讲, 在当下 2.0 这般很具有竞争力的状况下, 能够发觉生图模型存在着值得去深入探究的余地, 真的是十分难得的。
瞧腻了充斥于大街小巷的信息图, 偶然间会被某一些生成出来的中国仙境给震撼到, 从保持整体的一致性, 到有着密密麻麻的文字, 再到精准无误的编辑, 直至具备高水准美学品质, 我们究竟还能够期望怎样的AI生图呢。
算力还要继续建,但下一轮竞争已经转向交付
8月9日,央视新闻披露中国智能算力数据:规模达2185 EF...(156 )人阅读时间:2026-08-11
马斯克的新生图模型,让我笑了一整晚
Imagine官网可输入图片生成表情包,右侧边栏提供分层编辑...(176 )人阅读时间:2026-08-11
张一鸣罕见现身,字节要干把大的
字节跳动创始人张一鸣强调AI研发要避免模型蒸馏,不依赖竞争对...(128 )人阅读时间:2026-08-10
对话郎咸朋:具身也会有“蔚小理”,靠融资实现不了物理AGI
郎咸朋,前理想汽车智驾负责人,创立具身智能公司昆仑行,90天...(56 )人阅读时间:2026-08-10