图像理解与生成
豆包支持图像理解与图像生成,能够"看懂"图片,也能根据描述"画出"图片,为创意和内容生产提供强大支持。
图像理解
- 看图问答:上传图片,问豆包图中有什么、是什么。
- 文字识别:识别图片中的文字内容。
- 场景分析:理解图片场景、人物、物体、氛围。
- 图表解读:分析截图、图表中的数据信息。
图像理解示例
- "识别这张图片上的文字。"
- "这张图是什么场景?有什么值得注意的细节?"
- "帮我解读这张数据图表的趋势和结论。"
- "这张宣传海报的设计有什么亮点和可以改进的地方?"
图像生成
豆包可以根据你的文字描述生成图片,适用于配图、封面、海报、插画等。
- 场景描述:把想要的画面用文字描述清楚。
- 风格指定:说明想要的风格,如"卡通""写实""插画""扁平"。
- 用途说明:如"作为公众号头图""作为课程封面"。
图像生成示例
"请生成一张插画风格的公众号头图:一个可爱的蓝色小机器人助教,正在给一群小朋友上课,背景是明亮的教室,画风温馨活泼,适合儿童编程教育主题。"
使用技巧
- 描述越具体,生成效果越好:主体、动作、背景、风格、色调。
- 可以多生成几次,从中挑选满意的。
- 生成后可继续要求调整:"把背景改成星空""换成扁平风"。