扣子实操教程
27 分钟

Seedream生图教程:用AI生成和编辑高质量图片

前面讲了播客和海报。这篇讲扣子的图像生成能力——Seedream 模型,它能从文字生成图片、编辑已有图片、生成组图,支持 4K 高清输出。

井云团队
井云团队2026-08-31
返回专栏列表

前面讲了播客和海报。这篇讲扣子的图像生成能力——Seedream 模型,它能从文字生成图片、编辑已有图片、生成组图,支持 4K 高清输出。

Seedream 是什么

Seedream 是扣子内置的图像生成模型,目前有三个版本:4.0、4.5、5.0 Lite。

三个版本的核心能力对比:

| 能力 | 5.0 Lite | 4.5 | 4.0 |

|------|----------|-----|-----|

| 文生图 | 支持 | 支持 | 支持 |

| 生成组图 | 支持 | 支持 | 支持 |

| 图像编辑 | 支持 | 支持 | 支持 |

| 联网搜索 | 支持 | 不支持 | 不支持 |

| 分辨率 | 2K, 3K | 2K, 4K | 1K, 2K, 4K |

一个限制:输入的参考图数量加生成的图片数量不能超过15张。

三个版本各自的亮点

Seedream 5.0 Lite:联网检索加智能推理

5.0 Lite 比 4.5 多了三个能力:

联网实时搜索。能融合实时网络信息生成图片。比如让它做"杭州未来5日天气预报图",它会先联网查天气再生成。

这是Seedream工具根据指令生成的杭州未来5日天气预报图,对应该联网检索功能的实际效果展示,图片呈现了4月8日至12日的杭州天气情况,每天标注了具体的天气图标、气温区间,还搭配了符合当日气温的双人穿搭示例,直观体现了工具能结合联网查询的天气信息,生成契合需求的可视化内容。
这是Seedream工具根据指令生成的杭州未来5日天气预报图,对应该联网检索功能的实际效果展示,图片呈现了4月8日至12日的杭州天气情况,每天标注了具体的天气图标、气温区间,还搭配了符合当日气温的双人穿搭示例,直观体现了工具能结合联网查询的天气信息,生成契合需求的可视化内容。

图片展示了杭州未来5日天气预报及对应穿搭建议。周一晴天,22℃ - 30℃,建议穿短袖+牛仔裤;周二多云,21℃ - 29℃,建议穿薄长袖+半裙;周三小雨,19℃ - 26℃,建议穿薄卫衣+雨伞;周四阴天,20℃ - 27℃,建议穿开衫+阔腿裤;周五晴天,23℃ - 31℃,建议穿POLO+短裤。图片与上文提到的“让它做‘杭州未来5日天气预报图’,它会先联网查天气再生成”相呼应,直观呈现了天气情况。
图片展示了杭州未来5日天气预报及对应穿搭建议。周一晴天,22℃ - 30℃,建议穿短袖+牛仔裤;周二多云,21℃ - 29℃,建议穿薄长袖+半裙;周三小雨,19℃ - 26℃,建议穿薄卫衣+雨伞;周四阴天,20℃ - 27℃,建议穿开衫+阔腿裤;周五晴天,23℃ - 31℃,建议穿POLO+短裤。图片与上文提到的“让它做‘杭州未来5日天气预报图’,它会先联网查天气再生成”相呼应,直观呈现了天气情况。

编辑精准可控。生成图像和输入文本的契合度提升,能精准响应复杂指令。

比如输入"一只熊正在和一只驴在玩跷跷板,驴比熊重得多":

图片展示了一只驴和一只熊坐在跷跷板上。驴坐在左侧,面朝右侧,头微微抬起,耳朵竖起;熊坐在右侧,面向左侧,双手握着跷跷板的把手。背景是蓝天白云和绿树环绕的草地。该图片对应文档中“比如输入‘一只熊正在和一只驴在玩跷跷板,驴比熊重得多’”的示例,直观呈现了生成图像与输入文本的契合度。
图片展示了一只驴和一只熊坐在跷跷板上。驴坐在左侧,面朝右侧,头微微抬起,耳朵竖起;熊坐在右侧,面向左侧,双手握着跷跷板的把手。背景是蓝天白云和绿树环绕的草地。该图片对应文档中“比如输入‘一只熊正在和一只驴在玩跷跷板,驴比熊重得多’”的示例,直观呈现了生成图像与输入文本的契合度。

或者"将图中蓝色框内的水果改成葡萄,绿色框内的水果改成切开的苹果,红色框内增加一个蓝莓":

图片展示了Seedream 5.0 Lite在智能逻辑推理方面的应用示例。画面中有三个红色浆果,其中蓝色框内是一个切开的草莓,绿色框内是完整的浆果,红色框内是未框选的浆果。该图片与上下文紧密相关,用于说明在输入“将图中蓝色框内的水果改成葡萄,绿色框内的水果改成切开的苹果,红色框内增加一个蓝莓”指令后,Seedream 5.0 Lite能精准响应复杂指令,对图像进行编辑。
图片展示了Seedream 5.0 Lite在智能逻辑推理方面的应用示例。画面中有三个红色浆果,其中蓝色框内是一个切开的草莓,绿色框内是完整的浆果,红色框内是未框选的浆果。该图片与上下文紧密相关,用于说明在输入“将图中蓝色框内的水果改成葡萄,绿色框内的水果改成切开的苹果,红色框内增加一个蓝莓”指令后,Seedream 5.0 Lite能精准响应复杂指令,对图像进行编辑。

图片展示了一组水果在水中漂浮的场景。画面中有切开的苹果、蓝莓、葡萄和覆盆子,它们被气泡环绕,背景为清澈的水体。图片与上文提到的“将图中蓝色框内的水果改成葡萄,绿色框内的水果改成切开的苹果,红色框内增加一个蓝莓”指令相关,展示了在Seedream 5.0 Lite中,通过智能逻辑推理,可对图像进行编辑和修改的效果。
图片展示了一组水果在水中漂浮的场景。画面中有切开的苹果、蓝莓、葡萄和覆盆子,它们被气泡环绕,背景为清澈的水体。图片与上文提到的“将图中蓝色框内的水果改成葡萄,绿色框内的水果改成切开的苹果,红色框内增加一个蓝莓”指令相关,展示了在Seedream 5.0 Lite中,通过智能逻辑推理,可对图像进行编辑和修改的效果。

智能逻辑推理。更懂现实规律,支持复杂逻辑推演。比如"一张英文石油系统信息图表,显示石油钻井平台和地质层":

图片展示了石油钻井平台及地质层结构。上方是海洋表面,下方是海底沉积物、页岩盖层(不透水)、钻井管(钻井管)延伸至油藏、油藏(含原油和天然气)以及基底岩层(坚硬岩石)。钻井管连接着钻井平台,平台上有钻井设备。该图与上文提到的“一张英文石油系统信息图表,显示石油钻井平台和地质层”相契合,直观呈现了石油钻井平台与地质层的关联。
图片展示了石油钻井平台及地质层结构。上方是海洋表面,下方是海底沉积物、页岩盖层(不透水)、钻井管(钻井管)延伸至油藏、油藏(含原油和天然气)以及基底岩层(坚硬岩石)。钻井管连接着钻井平台,平台上有钻井设备。该图与上文提到的“一张英文石油系统信息图表,显示石油钻井平台和地质层”相契合,直观呈现了石油钻井平台与地质层的关联。

"两把文具尺子,上面是20cm塑料尺,下面是10cm钢尺":

图片展示了两把文具尺子,上方为20cm塑料尺,下方为10cm钢尺。塑料尺透明,刻度清晰,从0cm到20cm,每1cm有细小刻度,每5cm有较大刻度。钢尺为金属材质,表面有反光,刻度同样从0cm到10cm,每1cm有细小刻度,每5cm有较大刻度。该图片与文档中“两把文具尺子,上面是20cm塑料尺,下面是10cm钢尺”的描述相契合,直观呈现了尺子的样式和尺寸。
图片展示了两把文具尺子,上方为20cm塑料尺,下方为10cm钢尺。塑料尺透明,刻度清晰,从0cm到20cm,每1cm有细小刻度,每5cm有较大刻度。钢尺为金属材质,表面有反光,刻度同样从0cm到10cm,每1cm有细小刻度,每5cm有较大刻度。该图片与文档中“两把文具尺子,上面是20cm塑料尺,下面是10cm钢尺”的描述相契合,直观呈现了尺子的样式和尺寸。

Seedream 4.5:人像和美观度提升

4.5 比 4.0 在人像场景效果、画面美观度、一致性、编辑准确度上有提升。

人像场景优化——"将人物自然地嵌入罗马广场背景":

图片展示了一位身穿金色盔甲、头戴黑色头盔的女性角色,背景为红色和黑色的抽象图案,带有烟雾效果。她右手握拳,左手持剑,姿态英勇。画面右下角有“大爱中国”四个大字。该图片对应文档中“Seedream 5.0 Lite:联网检索加智能推理”版本人像场景优化的示例,展示了将人物自然地嵌入罗马广场背景的效果。
图片展示了一位身穿金色盔甲、头戴黑色头盔的女性角色,背景为红色和黑色的抽象图案,带有烟雾效果。她右手握拳,左手持剑,姿态英勇。画面右下角有“大爱中国”四个大字。该图片对应文档中“Seedream 5.0 Lite:联网检索加智能推理”版本人像场景优化的示例,展示了将人物自然地嵌入罗马广场背景的效果。

美观度提升——"哥特式美学,水墨淡彩,披甲穆桂英":

图片展示的是Seedream 4.0版本在美观度提升方面的示例。画面中,一位身着华丽盔甲、手持武器的女性角色,头戴色彩斑斓的头饰,背景以水墨淡彩风格呈现,带有中国传统文化元素。画面右下角有“大爱中国”字样。该图片与上下文紧密相关,直观呈现了4.0版本在美观度提升方面的效果,即通过哥特式美学和水墨淡彩等风格,使生成的图片更具艺术感和文化特色。
图片展示的是Seedream 4.0版本在美观度提升方面的示例。画面中,一位身着华丽盔甲、手持武器的女性角色,头戴色彩斑斓的头饰,背景以水墨淡彩风格呈现,带有中国传统文化元素。画面右下角有“大爱中国”字样。该图片与上下文紧密相关,直观呈现了4.0版本在美观度提升方面的效果,即通过哥特式美学和水墨淡彩等风格,使生成的图片更具艺术感和文化特色。

编辑准确度——"完成此图像以形成完整的恐龙形象并为其着色":

这张图片对应的是Seedream生图教程中关于编辑准确度的示例内容,该示例要求是“完成此图像以形成完整的恐龙形象并为其着色”。图片呈现的是一幅简笔画,仅绘制了恐龙头部及双爪的线条轮廓,线条简洁清晰,是未完成的恐龙局部形象,用于展示通过该AI工具可对这类不完整的恐龙图像进行编辑补全和着色处理,体现Seedream在图像编辑方面的应用效果。
这张图片对应的是Seedream生图教程中关于编辑准确度的示例内容,该示例要求是“完成此图像以形成完整的恐龙形象并为其着色”。图片呈现的是一幅简笔画,仅绘制了恐龙头部及双爪的线条轮廓,线条简洁清晰,是未完成的恐龙局部形象,用于展示通过该AI工具可对这类不完整的恐龙图像进行编辑补全和着色处理,体现Seedream在图像编辑方面的应用效果。

Seedream 4.0:首次支持多模态生图

4.0 是基础版本,首次支持文生图、图像编辑、生成组图。

基本能力速查

Seedream 支持的编辑操作,记住指令格式就行:

元素增删

  • 增加元素:"给 XX 加 XX"
  • 删除元素:"去除 XX"

改变风格

  • "将画面改成 XX 风格"(绘本、像素、2D卡通、盲盒、水墨等)

改变光影和色调

  • 光影:"将画面光影改成 XX"(逆光、侧光、柔光、夕阳等)
  • 色调:"将画面色调改成 XX"(暖色调、冷色调、黑白、低饱和等)

改变材质和背景

  • 材质:"将材质改成 XX"(粘土、毛绒、毛毡、石头、金属等)
  • 背景:"将背景改成 XX"(森林、儿童房、图书馆等)

改变视角和景别

  • 视角:"将视角改成 XX"(正面平视、侧面、背面、斜侧)
  • 景别:"将景别改成 XX"(远景、全景、特写、大特写)

海报编辑

  • 字体:"将标题字体改成 XX"(手写体、书法体、哥特体等)
  • 文字内容:"将 XX 文字内容改成 XX"
  • 文字颜色:"将标题字体颜色改成 XX"
  • 文字材质:"将文字材质改成 XX"(云朵、液态金属、涂鸦喷漆等)

几个典型生成效果

设计类

图片展示的是一只卡通恐龙,整体呈绿色,身体两侧有浅绿色条纹。它张开大嘴,露出锋利牙齿,表情凶猛。恐龙四肢粗壮,尾巴弯曲。该图片位于“生成写真”内容之后,可能用于说明生成写真功能,即基于上传照片生成类似风格的恐龙图片,以展示AI生成图片的效果。
图片展示的是一只卡通恐龙,整体呈绿色,身体两侧有浅绿色条纹。它张开大嘴,露出锋利牙齿,表情凶猛。恐龙四肢粗壮,尾巴弯曲。该图片位于“生成写真”内容之后,可能用于说明生成写真功能,即基于上传照片生成类似风格的恐龙图片,以展示AI生成图片的效果。

商业产品摄影风格:

图片展示了一只卡通风格的恐龙,位于画面中央。恐龙身体呈绿色,背部有灰色条纹,四肢粗壮,脚掌有三趾,趾端有尖锐的爪子。背景是荒漠景观,有棕榈树、岩石和灌木丛,远处还有几棵棕榈树。图片与上下文的关系是,作为知识科普类图片的示例,以粉笔质感呈现火山喷发过程,上方用简短文字解释岩浆积聚压力并喷发的原理,并用气球作比喻辅助理解。
图片展示了一只卡通风格的恐龙,位于画面中央。恐龙身体呈绿色,背部有灰色条纹,四肢粗壮,脚掌有三趾,趾端有尖锐的爪子。背景是荒漠景观,有棕榈树、岩石和灌木丛,远处还有几棵棕榈树。图片与上下文的关系是,作为知识科普类图片的示例,以粉笔质感呈现火山喷发过程,上方用简短文字解释岩浆积聚压力并喷发的原理,并用气球作比喻辅助理解。

知识科普

一张黑板报形式的手绘科普信息图,以粉笔质感呈现火山喷发过程。上方用简短文字解释岩浆积聚压力并喷发的原理,并用气球作比喻辅助理解。

修改图片

基于下面的图片,给女孩加个帽子,加个双肩包,女孩闭上嘴巴微笑

生成写真

将上传的照片转换成高分辨率的黑白肖像艺术作品,背景呈现柔和渐变效果,营造出层次感与寂静氛围。

多图融合

将图1中的几支花按品种分类,分别插在图2的三个花瓶中

进阶:用工作流和智能体封装生图能力

如果你想把 Seedream 封装成一个可重复使用的生图服务,可以用低代码工作流加智能体的方式。

搭建生图工作流

工作流包括三个节点:

开始节点:接收用户输入。定义两个参数:

  • prompt(必选,String 类型):图像生成提示词
  • image1、image2、image3(可选,Image 类型):最多3张参考图

提示词尽量详细准确,帮 Seedream 更好地理解需求。

图像生成节点:调用 Seedream 4.0 模型生成图片。配置:

  • 模型选 Seedream 4.0
  • 比例设为自定义
  • 打开图片水印开关
  • 最大生成图片数量设为15张
  • 参考图引用开始节点的 image1、image2、image3
  • 提示词引用 {{prompt}}

结束节点:输出图像 URL。输出模式选"返回文本",变量 output 引用图像生成节点的输出参数 data,回答内容设为 {{output}}。

搭建生图智能体

工作流搭好后,建一个智能体绑定这个工作流。

智能体的提示词参考:

角色

你是一名经验丰富的资深图像处理师,拥有超过10年的专业实践经历。在图像生成、风格迁移、细节优化、内容融合以及图像编辑等图像处理核心领域有着深厚造诣。

技能

技能 1:执行图像生成指令

当用户明确给出图像生成指令、提供参考图后,迅速且准确地执行生图工作流进行图片处理。

限制

只专注于图像处理相关的任务和问题,拒绝回答与图像处理无关的话题。

绑定工作流后,加一个返回卡片。用户输入提示词和参考图,智能体调用工作流生成图片,以卡片形式返回。

做完之后

你已经掌握了:

  • Seedream 三个版本的区别和选择
  • 基本编辑能力(增删元素、改风格、改光影、改材质等)
  • 典型生成效果(设计、科普、修图、写真、多图融合)
  • 用工作流和智能体封装生图能力

AI 生图是做内容创作和设计服务的基础能力,把生图能力封装成智能体产品,也是井云共创圈里很多人在做的变现方向。

关于井云

井云是帮个人把 AI 能力变成可付费产品的平台。把 Seedream 生图能力封装成智能体产品或设计服务变现,加入井云共创圈获得商业化支持。

扫码加入井云共创圈企业微信群:

图片展示的是井云Studio共创圈10的群二维码。上方显示“群二维码”及“井云Studio共创圈10”,并有“使用微信或企业微信扫码加入”的提示。中间是一个较大的二维码,下方标注“该二维码7天内(9月7日前)有效”。该图片位于文档介绍井云平台,鼓励加入井云共创圈企业微信群以获取商业化支持的部分,是加入共创圈的扫码入口。
图片展示的是井云Studio共创圈10的群二维码。上方显示“群二维码”及“井云Studio共创圈10”,并有“使用微信或企业微信扫码加入”的提示。中间是一个较大的二维码,下方标注“该二维码7天内(9月7日前)有效”。该图片位于文档介绍井云平台,鼓励加入井云共创圈企业微信群以获取商业化支持的部分,是加入共创圈的扫码入口。

相关标签:
#AI Agent
#井云Studio
#扣子实操教程
开启企业级 AI 商业化

立即构建您的专属 AI 智能体与自动化矩阵

井云 Studio 为您提供多租户底座、工作流编排、资产分发与计费闭环,助您快速上线高质量 AI SaaS 产品。

延伸推荐阅读

Agent的记忆机制:让它越用越懂你
扣子实操教程

前面你创建了 Agent,给它加了技能。这篇深入讲记忆,这是扣子 Agent 区别于普通对话工具的核心能力。

井云团队
井云团队
详情
Excel处理:一句话搞定表格分析
扣子实操教程

做Excel是件重复又耗时的事。数据清洗、公式计算、图表生成、报表整理,每一步都要花时间。扣子内置了"Excel"技能,你输入一句话描述需求,它自己读表格、筛数据、算结果、画图表、出报表。

井云团队
井云团队
详情