AI绘画实战:通义万相API接入
通义万相是阿里云的AI图像生成模型,支持文生图、图生图、局部重绘、风格迁移等多种能力。通过API可以快速集成AI绘画功能到应用中。本文介绍通义万相的API接入和实战技巧。
基础接入
使用DashScope SDK调用:from dashscope import ImageSynthesis; rsp = ImageSynthesis.call(model='wanx-v1', prompt='一只可爱的橘猫在阳光下打盹', n=4, size='1024*1024')。返回4张图片的URL。支持多种尺寸:1024x1024(正方形)、720x1280(竖版)、1280x720(横版)。
Prompt技巧
好的Prompt是生成高质量图片的关键。描述要具体:包含主体(什么)、环境(在哪里)、风格(什么画风)、光线(什么光照)、构图(什么角度)。
示例对比:差的Prompt"一只猫" → 好的Prompt"一只橘色波斯猫坐在窗台上,窗外是雨天的城市风景,水彩画风格,柔和的自然光,特写镜头"。
负面Prompt:告诉模型不要生成什么。如"不要模糊、不要变形、不要文字水印"。
高级功能
图生图:传入参考图+文字描述,生成风格相似但内容不同的图片。适合电商换背景、风格迁移。
局部重绘:指定图片中的某个区域,用文字描述重新生成该区域。适合修改图片的局部细节。
人像风格化:传入人像照片,生成动漫风格、油画风格、素描风格等不同版本。
应用场景
电商商品主图生成、社交媒体配图、海报设计素材、游戏概念设计、教育插图、室内设计效果图。注意生成图片的版权问题和合规使用。
