文本图像生成算子 (GenerateImage)
算子定义与核心定位
GenerateImage 算子负责将自然语言文本提示词 (Prompt) 转化为生动、细腻的高品质视觉图像。该节点深度集成了底层云端图像生成驱动与提示词增强引擎,支持以工业级标准动态生成各类视觉素材。
适用业务场景
在以下工作流场景中应选用此节点:
- 需要根据上下文动态实时绘制视觉配图或艺术插画;
- 将前序智能体分析产出的文本描述或创意设定转化为具象的视觉图像;
- 自动化生成多模态概念图、产品样机渲染或创意视觉原型。
使用指引与步骤
基础搭建流程
- 从左侧算子库将 GenerateImage 节点拖入工作区画布;
- 在
prompt参数框中输入详细的画面描述,或者连入上游生成的提示词; - 点击运行节点或整个工作流!
核心入参说明 (Parameters)
- agent:负责处理前置提示词润色与图像生成任务调度的可选 Agent 实例;
- image_generation_driver:底层具体的生图驱动器(缺省时自动使用平台默认驱动);
- prompt:核心入参,描述期望生成的画面内容、主体、构图与艺术风格的文本字符串;
- enhance_prompt:布尔开关(默认值为
True),决定是否调用内建的提示词优化模型对原始文本进行自动化扩写以提升成图细节与画质。
产出端口说明 (Outputs)
- output:生成的图像资产实体,以强类型的
ImageUrlArtifact格式输出,可安全地在后续算子间传递、直显或保存。
快速实操范例
搭建一个极简生图并保存的流水线:
- 向画布中添加一个 GenerateImage 节点;
- (可选)连接一个 Agent 节点至其
agent参数端口; - 将
prompt设置为:"A serene mountain landscape at sunset with a lake reflecting the orange sky"(落日余晖下宁静的群山风光,平静的湖面倒映着橙红色的晚霞); - 将该节点的
output端口连入一个 SaveImage 节点,指定本地存储目标; - 运行工作流,即可在本地磁盘获取高质量的生成画作。
关键工程注意事项
- 凭证配置:若使用默认的 Griptape Cloud 服务,必须确保环境变量中已配置有效的
GT_CLOUD_API_KEY; - 默认模型规格:系统默认采用 DALL-E 3 高清画质 (
quality: "hd") 规格进行渲染; - 提示词增强的影响:开启
enhance_prompt能够显著丰富光影、构图与材质细节,但在某些追求精准抽象符号或简笔画的场景下,可能会引入额外的主观艺术解读。若需完全忠实于简短提示词字面含义,请将此项置为False。