查看: 4|回复: 0

实测完这个国产 AI 生图,我发现了下一个刷屏玩法

[复制链接]

1万

主题

0

回帖

5万

积分

论坛元老

积分
58935
发表于 2026-7-15 11:20:59 | 显示全部楼层 |阅读模式
AI 生图最难的地方,早就从「生成一张好看的图」变成了「把那张差一点的图改对」。一张图看起来快能交了,偏偏一个帽子和主视觉的色号错了,海报小字糊了,人物年龄跑偏了。我们只想修一个角落,模型转身把构图、光线、脸一起重画了。等待重新生成的过程都在想,明明只是错了 5%的图,修改起来的代价却像错了 100%。【图片1】最近,字节跳动旗下 AI 和云服务——火山引擎正式发布新一代多模态图像创作模型的API服务, Seedream 5.0 Pro。这是一款同时覆盖图像生成与编辑的模型,文生图、参考图生成、多图融合和局部精确修改都在它的能力范围里。在我们的实际体验中,除了在效果上完全可以替代 Nano Banana2,Seedream 5.0 Pro 最能被直观感知到的特色,是交互式精准编辑。现在我们可以用圈选、点位、箭头、坐标或色号告诉模型「改哪里」「改成什么」,大幅度减少了用自然语言描述位置时的误差。【图片2】提示词:帮我完成上述所有选择题,并用红色签字笔写上对应的演算过程在上面这个 case 中,Seedream 5.0 Pro 能够准确完成一张高考数学试卷,并在对应位置写上答案。这大概是第一次生图模型能把答案填在对的位置上,精准到填空题的位置坐标范围内,实现对位置的精准编辑。我们甚至都没有框选、点选,告诉它把哪个答案放在哪里。另一项升级带来的明显体验变化,是信息图生成。Seedream 5.0 Pro 现在也能像 GPT-Image-2、Nano Banana 2 一样,把长文字和复杂信息等内容,准确渲染、排版成各种海报、PPT、会议议程、电商详情页等图片。【图片3】而像之前 AI 生图普遍存在的 AI 味,一眼假等问题,我们发现 Seedream 5.0 Pro 也在生图的风格上进行了修复。无论是生成含有人物形象的图片,还是各种影视和游戏画面,风格的把握现在都更符合真实图片的标准。目前 Seedream 5.0 Pro 已经在字节旗下多个平台上线,我们可以选择自己常用的平台进行体验:1.火山方舟体验中心-视觉模型-图片生成-Doubao-Seedream-5.0-pro,API 也已全量上线火山方舟;2.即梦网页端-图片生成/Agent 模式-选择图片 5.0 Pro;3.豆包 App/电脑版-AI 创作-图片生成-选择模型 Seedream 5.0 Pro;4.以及海外版 AI 创作平台 Lumina 等从交互式编辑的能力、含有大量文字的高密度信息图生成,到风格化和多语言控制,Seedream 5.0 Pro 这次的升级可以说是相当明显。我们也根据模型的能力,测试了非常多有意思的玩法,AI 生图要进入设计、营销、电商以及各种办公场景,现在是越来越容易了。AI 生图,终于不用整张重来了有人曾专门做了一个 AIGC 图像创作的分布统计,数据显示在真实生图场景中,文生图占比大概是 20% 多,70% 多都是图片编辑。这次 Seedream 5.0 Pro 更新的重点首先也放在了图像编辑上,精准改图的功能让图片编辑告别抽卡。以前我们要修改一张图,通常只能用语言描述:「把左下角的红色棋子向右移动一格」「把绿色框里的物体变成透明泡泡」「把黄色框换成暖灰米色毛线球」。哪怕是曾经爆火的「桌面手办」改图玩法,我们都得靠着复制粘贴专门的提示词,才能控制好模型不出差错。【图片4】其中的问题在于,自然语言对模型来说不够准确,不便于理解。我们说左下角,模型可能理解成边缘;说旁边,模型可能把邻近元素一起改掉。现在,Seedream 5.0 Pro 交互式精准编辑的能力,支持包括圈选、点位、箭头、标注框、坐标等方式指定位置,也可以用涂鸦、色块、线条、简笔画作为编辑示例,再配合自然语言生成对应物体或细化画面。【图片5】我们在即梦和 Lumina 平台,都测试了这项功能。打开 Seedream 5.0 Pro,上传图片之后,将鼠标悬浮在图片上,Lumina 就会自动弹出「手绘修图」的菜单,点击就能进行精准编辑操作。即梦则是在图片生成之后,查看所选图片,页面右侧下方的「智能改图」可以直接进入图片的编辑页面,用各种标记对图片进行修改。【图片6】【图片7】这些操作听起来就像是给模型加了一支笔,我们指哪改哪。实际的体验,模型会把这些点位翻译成输入的一种,它可以同时接收到我们想要什么样的图,以及想要修改的具体位置。我们从网络上找了一张办公桌的配置图,里面有椅子、电脑、鼠标、字母灯牌以及墙上挂着的几幅画。如果单单是要生图模型修改后面几幅画的位置,我们就要用大量文字提示词说清楚,现在只是几个箭头,然后告诉模型按照箭头调整三幅画的顺序。【图片8】此外,还能通过矩形框选,直接把椅子框起来,要求模型修改椅子的材质为积木。电脑的壁纸、灯牌上的文字,鼠标的颜色,都能在一句话的提示词里面涵盖全部的修改。【图片9】提示词:Region01 把椅子修改为乐高积木材质,Region02 桌面风景修改为夏季, Mark01 鼠标换成 #FFFFFF, Region03 字母修改为「BE WHAT YOU WANNA BE」,然后按照箭头顺序调整三幅图的顺序位置这种需要通过交互式精准编辑才能定位的能力,让我想起以前如果要求模型找到特定位置,往往需要使用极其复杂的语言描述。就像这张毕业照,如果我只是说「中间的学士帽修改为蓝色」,首先模型可能根本不知道我要求的「中间」到底是哪里,其次模型也不知道「蓝色」是什么色。【图片10】提示词:把 Region01 这个位置的学士帽颜色修改为 #1F7AFB能指定位置也能指定颜色,让这种修改可以更大胆一点,把其中一些学士帽修改为魔法学院的帽子、鸭舌帽、甚至摘掉,都能在交互式精准编辑里面,把点选作为输入。【图片11】【图片12】我们还找了一张毕业合照,用画笔圈出里面的两个人,就能让这张毕业合照变成只是他们两个人的合照。【图片13】提示词:把这框住的两个人单独放在一张合照里,背景使用原图的操场背景虽然「把 PS 做进模型里」这个说法有点夸张,但交互式精准编辑确实抓住了一件事:AI 图像工具正在从整图生成,转向对象级、区域级、图层级的操作。这张世界杯的观众图片,原图是墨西哥对战南非,我们用框选把这部分框起来,然后在提示词输入框里直接@这个框选,就能让它修改为中国队和墨西哥对战,甚至中国队还能 3:0 打败墨西哥。【图片14】接着框住脸,把衣服圈起来,然后再用上哈兰德同款发型和姿态,Seedream 5.0 Pro 就这样像 PS 修图一样,一点一点地改好这些指定的位置。类似的编辑,几乎在各类场景下都能准确定位然后修改。【图片15】提示词:把 Mark01的台灯修改为 Image002,把 Region01的抱枕颜色修改为#1F7AFB,在蓝色线条描绘的墙壁上彩绘上一只 3D 立体巨型小猫,按照蓝色线条躺在墙上;一只小猫躺在红色线条圈住的地方,Region02 这把椅子的材质修改为玻璃材质。这种精准编辑的能力,还能结合最多十张图的图像融合,让我们直接把一个空房子,按照自己的布局想法,生成完整的预览图。【图片16】【图片17】而有关图层级别的操作,Seedream 5.0 Pro 这次还带来了「多图层分离」的能力,只用一句话,模型可以把一张图片上的元素全部分成可以调整的图层。对图片要求更高的朋友,还可以拿着 Seedream 5.0 Pro 抠好的图,放在传统的专业工具 PS、Canva 里进一步编辑、融合。【图片18】官方给出了多个案例,例如调整奶茶宣传海报上,不同文字的位置、层级等。【图片19】以及对博客的封面进行调整,就像是在 PS、Canva 等工具内操作一样。【图片20】一句话生成各种复杂信息图信息图真正火起来大概还是 GPT-Image-2 的出现,我们开始发现 AI 竟然能如此准确地渲染中文。现在这项能力也来到了 Seedream 5.0 Pro 上,虽然部分小字偶尔还是需要抽卡,但水平完全达到了 Nano Banana 2 的水准,并且使用起来要更方便更便宜。先来个简单的,「用一张信息图讲解清楚台风是怎么来的和怎么没的」【图片21】提示词:用一张信息图讲解清楚台风是怎么来的和怎么没的,2K 画质。还有相机的爆炸拆解信息图。【图片22】提示词:一个相机的爆炸拆解详细信息图,2K 画质以及曾经让马斯克和奥特曼都在抖音直播的截图,现在 Seedream 5.0 Pro 也能直接生成类似的直播画面。【图片23】提示词:一个漂亮的女生主播在抖音直播(左),一个帅气的男生主播在抖音直播(右)准确渲染文字的能力,会特别适用于各种产品的渲染。例如我们只是用一句提示词,Seedream 5.0 Pro 就给了四种不同的电商主图方案,每一个都像是广告图。【图片24】提示词:生成一张一款夏日饮料的电商主图。主题是夏日冰爽,背景有冰块、水珠和浅色桌面,突出罐身文字和 logo。主标题写「草莓白桃气泡水」,副标题写「0 糖 0 脂 轻盈果香」。角落加入小标签「330ml」「低卡」。除了电商,用来打造个人品牌,生成适用于小红书的图片,基本上也都是一次成型。【图片25】提示词:我想提供帮人做网页简历的服务,帮我生成几张可以用来发小红书的宣传广告图,就是我会根据网友提供的简历信息,帮他做一个网页,让我给他一个链接,他可以直接分享出去,最主要是要够吸引人,帮我吸引到目标客户,设计要大胆新颖有潮流我们还用更多的文字来考验它,把一个岗位描述发给 Seedream,要求它根据文案,生成一张吸引人的海报。【图片26】提示词:我们最近在招人,请你根据这个JD,帮我生成一张吸引人的招聘海报 AI 方向编辑。后续提示词:参考这个图片的风格和样式控制,帮我再生成同样风格类型的另一个岗位招聘海报,下面是岗位的信息。其中图一是当时 Seedream 5.0 Pro 给的四张图里的其中一个,当我们想要其他的岗位描述也按照这个风格进行时,只需要上传第一张图片,告诉模型,「参考这个图片的风格和样式控制」。说实话,这个参考能力还是比较强的,整体的画风是统一的。左边岗位职责,右边岗位要求,针对 AI、硬件产品、视频又有专门的个性化元素和文案,例如底部的宣传标语就自动适配了,插画部分也有导演椅、手机电子设备等作为区分。而如果有专门的设计规范文档,也可以直接发给 Seedream。我们把之前用来在 GPT-Image-2 生图中使用的规范文档,将近 2000 字和提示词一起发给豆包,要求它按照设计规范来生图。最后的效果基本上和用 GPT-Image-2 类似,遵循了我们的设计规范,图片底色、强调颜色等,都按照文档要求进行设计。【图片27】提示词:按照这个设计规范,帮我设计一张发生洪水时,我们应该怎么做的信息指引图。文字如果再多一点,Seedream 5.0 Pro 可能就会有点吃力了,但是多尝试两次,基本上还是能得到令人满意的结果。【图片28】提示词:活动名称:2026 AI 图像生产力沙龙 日期:2026 年 7 月 18 日 地点:深圳湾科技中心 B 座 3F 多功能厅 09:30-10:00 签到入场|体验区开放 10:00-10:10 开场致辞|李超凡,APPSO 主理人 10:10-10:40 主题演讲:从抽卡出图到可控生产|周亦宁,视觉模型产品负责人 10:40-11:10 案例分享:AI 如何进入电商素材流水线|陈嘉禾,品牌视觉负责人 11:10-11:30 茶歇交流|Demo 展台体验 11:30-12:00 圆桌讨论:设计师还需要掌握哪些新能力|主持人:何一凡;嘉宾:许棠、孟舟、...










回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖
返回顶部