Design & media

豆包图片生成-免费版

Try it

轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

What it does

**功能说明**: 本技能涵盖 中文交互、与基础提示词、化工作流场景 等核心能力。

The skill document

功能说明: 本技能涵盖 中文交互、与基础提示词、化工作流场景 等核心能力。

豆包图片生成工具 - 免费版

概述

豆包图片生成免费版是一款面向个人用户的轻量级 AI 图片生成工具。它通过标准化的生成流程(确认需求 → 输入提示词 → 设置比例 → 生成 → 截图确认 → 下载保存),帮助用户快速将创意想法转化为视觉作品。

免费版聚焦核心生成场景:单张图片生成、基础比例选择、生成结果确认与下载。配置简单,适合以下用户:

  • 个人用户快速生成创意图片
  • 社交媒体创作者制作配图
  • 设计师快速预览设计灵感
  • AI 绘图初学者入门体验

免费版限制:单次生成 1 张图片,默认 3:4 比例,不支持批量生成、多比例输出、风格预设、提示词增强等高级能力。如需这些能力,请使用 PRO 版本。

核心能力

能力清单

能力描述免费版
单图生成生成一张 AI 图片支持
提示词输入自定义提示词支持
比例选择选择图片比例支持(3:4 默认)
截图确认生成后截图供用户选择支持
图片下载下载原图到本地支持
简易提示词优化基础提示词建议支持
批量生成多图同时生成不支持
多比例输出同时生成多比例不支持
风格预设预设风格模板不支持
提示词增强AI 增强提示词不支持
参考图生成基于参考图生成不支持
工作流自动化批量自动化不支持

输出: 返回能力清单的执行结果,包含操作状态和输出数据。

工作流程

询问用户生成需求
      ↓
用户确认提示词与比例
      ↓
输入提示词到生成页面
      ↓
设置图片比例(默认 3:4)
      ↓
点击生成按钮
      ↓
等待生成完成
      ↓
截图 4 张候选图发给用户
      ↓
用户选择并确认
      ↓
下载图片到本地
      ↓
复制到指定目录

输出: 返回工作流程的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

生成流程关键步骤

  1. 需求确认:先询问用户想要什么样的图片
  2. 提示词输入:用户确认后输入提示词
  3. 比例设置:默认 3:4,用户可选其他比例
  4. 生成触发:点击发送按钮(向上箭头),不按回车
  5. 结果截图:生成完成后立即截 4 张图
  6. 用户选择:通过 message 工具发给用户选择
  7. 确认下载:用户选好后点开大图确认
  8. 保存图片:点击下载原图保存
  9. 复制到目标目录:复制到指定文件夹

输出: 返回生成流程关键步骤的执行结果,包含操作状态和输出数据。 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:轻量级、图片生成工具、支持单图生成与基、适合个人用户快速、创作视觉内容、豆包图片生成免费、为个人用户提供轻、量化的、图片生成能力、核心能力、单张图片生成、按提示词创作、基础比例选择、生成结果截图确认、图片下载与保存等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。

核心功能执行

执行核心功能执行操作,使用input_params参数进行配置。

输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

使用场景

场景 1:社交媒体配图创作

小张需要为社交媒体帖子生成一张配图。

操作步骤:

  1. Agent 询问:「您想要什么样的图片?有什么提示词要求?」
  2. 用户回答:「想要一张温馨的咖啡店场景,暖色调」
  3. Agent 输入提示词,设置 3:4 比例
  4. 生成完成后截图 4 张候选图
  5. 通过 message 工具发给用户选择
  6. 用户选择后下载保存

示例交互:

Agent: 您想要什么样的图片?有什么提示词要求?
用户: 想要一张温馨的咖啡店场景,暖色调
Agent: 好的,我将为您生成一张温馨咖啡店场景的图片,比例 3:4
[生成中...]
Agent: 已生成 4 张候选图,请选择您喜欢的一张
[发送 4 张截图]
用户: 我选第二张
Agent: 好的,已为您下载第二张图片并保存

场景 2:设计灵感预览

小李是设计师,希望快速预览某个设计概念。

操作步骤:

  1. Agent 询问需求
  2. 用户提供设计概念提示词
  3. Agent 生成图片
  4. 设计师查看候选图获取灵感

示例提示词:

提示词:现代简约风格客厅,大面积落地窗,木质地板,米色沙发,绿植点缀,自然光照明亮
比例:3:4

场景 3:学习 AI 绘图入门

小王想学习 AI 绘图,从简单的提示词开始尝试。

操作步骤:

  1. Agent 询问想要什么样的图片
  2. 用户输入简单提示词(如「一只可爱的橘猫」)
  3. Agent 给出提示词优化建议
  4. 生成图片并展示结果

示例提示词优化:

原始提示词:一只可爱的橘猫
优化建议:一只毛茸茸的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调,3:4 比例

不适用场景

以下场景豆包图片生成-免费版不适合处理:

  • 3D建模和动画制作
  • 照片级写实渲染
  • 手绘原创插画

触发条件

需要设计创作、UI设计、海报制作、品牌视觉时使用。不适用于非本工具能力范围的需求。

快速开始

领先步:需求确认

收到任务后,领先步必须是询问用户:

Agent: 您想要生成什么样的图片?
       - 主题内容是什么?
       - 风格偏好(写实/卡通/油画等)?
       - 比例要求(默认 3:4)?
       - 其他特殊要求?

第二步:输入提示词

用户确认需求后,输入提示词到生成页面:

[打开豆包 AI 创作页面]
[输入用户确认的提示词]
[设置比例为 3:4(或用户指定比例)]

第三步:生成图片

点击发送按钮(向上箭头)触发生成:

[点击发送按钮 - 不要按回车]
[等待图片生成完成]

第四步:截图与选择

生成完成后立即截图 4 张候选图:

# 示例
# 通过 message 工具发送图片给用户选择
message --image /tmp/candidate-1.jpg --text "候选图 1"
message --image /tmp/candidate-2.jpg --text "候选图 2"
message --image /tmp/candidate-3.jpg --text "候选图 3"
message --image /tmp/candidate-4.jpg --text "候选图 4"

第五步:下载与保存

用户选择后,点开大图确认并下载:

# 下载用户选择的图片
# 复制到指定目录
cp /tmp/selected-image.png /target/directory/

配置示例

生成参数说明

参数类型默认值说明
提示词字符串必需描述要生成的图片内容
比例字符串3:4图片宽高比
数量整数4候选图数量
保存路径字符串/tmp/下载保存目录

支持的比例

免费版支持以下比例:

比例适用场景
3:4(默认)竖版社交媒体
1:1方形头像
4:3横版配图
16:9宽屏壁纸

提示词建议格式

[主体描述] + [风格] + [色调] + [细节] + [比例]

示例:
一只毛茸茸的橘猫(主体)
写实风格(风格)
暖色调(色调)
坐在窗台上 阳光洒在身上(细节)
3:4 比例

优选实践

1. 提示词撰写技巧

# 推荐:详细具体
一只可爱的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调

# 不推荐:过于简单
猫

2. 比例选择建议

用途推荐比例
朋友圈/小红书3:4
头像1:1
公众号配图4:3
手机壁纸9:16

3. 生成流程规范

  1. 必须先询问用户需求,不要直接生成
  2. 用户确认后再输入提示词
  3. 点击发送按钮(向上箭头),不要按回车
  4. 等待图片完全生成后再截图
  5. 用户选好后要点开大图确认
  6. 用户确认后才能下载保存
  7. 每步必须拿到结果才能进行下一步

4. 截图与发送规范

  • 截图必须用 message 工具发送图片给用户
  • 不要使用虚拟路径
  • 截图路径使用实际路径

常见问题

Q1:为什么必须先询问用户?

A: 询问用户需求可以:

  • 明确生成方向,避免浪费
  • 了解用户的风格偏好
  • 确认比例要求
  • 提升用户满意度

Q2:点击发送还是按回车?

A: 必须点击发送按钮(向上的箭头),不要按回车。按回车可能导致提示词格式错误。

Q3:生成的图片不满意怎么办?

A: 可以:

  1. 重新生成(调整提示词)
  2. 从 4 张候选图中选择最接近的
  3. 优化提示词后再生成

Q4:免费版支持哪些比例?

A: 支持常见比例:3:4、1:1、4:3、16:9。默认使用 3:4。如需更多比例或同时输出多比例,请使用 PRO 版本。

Q5:能否批量生成多张图片?

A: 免费版仅支持单次生成。如需批量生成,请使用 PRO 版本。

Q6:图片保存在哪里?

A: 默认保存到 /tmp/ 目录。建议复制到指定目录长期保存:

cp /tmp/generated-image.png /your/directory/

Q7:能否使用参考图生成?

A: 免费版仅支持文本提示词生成。如需基于参考图生成,请使用 PRO 版本。

依赖说明

运行环境

  • Agent 平台:支持 SKILL.md 规范的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
  • 操作系统:Windows / macOS / Linux
  • 浏览器:需要浏览器访问豆包 AI 创作页面
  • 网络:需要网络连接(访问豆包服务)

依赖详情

依赖项类型是否必需获取方式版本要求
浏览器应用必需系统自带Chrome 100+
message平台工具必需Skill 平台安装-
豆包账号服务必需豆包平台注册-
LLM APIAPI必需由 Agent 内置 LLM 提供-

环境准备

# 验证浏览器
google-chrome --version

# 验证 message 工具
which message

# 验证工作区目录
ls $HOME/.skill-platform/workspace/

API Key 配置

免费版需要以下配置:

配置项环境变量用途获取方式
豆包账号浏览器登录访问豆包 AI 服务豆包平台注册
Skill 平台 Token平台配置平台认证Skill 平台控制台
# 本技能的核心实现逻辑
# 请参考上方使用说明进行配置和调用
echo "implementation_ready"

可用性分类

  • 分类:MD+EXEC(Markdown 指令 + 命令行执行 + 浏览器自动化)
  • 说明:通过自然语言指令驱动 Agent 操作浏览器完成图片生成
  • 离线可用:否(需要网络访问豆包服务)
  • 隐私等级:中(提示词需上传至豆包服务)

版本说明

  • 当前版本:1.0.0
  • 版本类型:FREE(免费版)
  • 升级路径:如需批量生成、多比例输出、风格预设、提示词增强、参考图生成等能力,请使用 doubao-image-gen-tool-pro

错误处理

错误场景原因处理方式
配置错误参数缺失或格式错误检查依赖说明中的配置要求
运行时错误运行环境不满足确认运行环境符合依赖说明
网络错误连接超时或不可达执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案

已知限制

  • 需LLM支持,无LLM环境不可用
  • 复杂业务场景建议结合人工经验判断
  • 执行效率受模型能力与网络环境影响

示例

基本用法

输出:返回执行结果,包含操作状态和输出数据

用户: 执行核心功能
Skill: 正在执行核心功能...
Skill: 执行完成,结果如下: 操作成功

安全注意事项

风险类型防范措施
API密钥泄露通过环境变量配置,禁止硬编码到代码或配置文件中
命令执行风险仅执行白名单命令,避免拼接用户输入到命令行参数中
网络通信安全使用HTTPS协议,验证SSL证书有效性
敏感数据暴露输出结果中不包含密钥、令牌等敏感信息

使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。

核心功能

  • 自动化执行: 基于指令驱动的自动化流程
  • 文件处理: 支持多种文件格式的读取、解析和写入操作
  • API集成: 通过标准化接口调用外部服务并处理响应
  • 命令执行: 在安全沙箱中执行系统命令并收集结果
  • 信息检索: 快速搜索和过滤目标数据

核心功能

  • 自动化执行: 基于指令驱动的自动化流程
  • 文件处理: 支持多种文件格式的读取、解析和写入操作
  • API集成: 通过标准化接口调用外部服务并处理响应
  • 命令执行: 在安全沙箱中执行系统命令并收集结果
  • 信息检索: 快速搜索和过滤目标数据

Related skills

Turn China 3C launch inputs into executable routes, messaging, channel actions, risk checks, and review decisions.

by killsnake0126 installs112 stars

Convert Word, PDF or PPT into browser-ready HTML slides with step animations, fullscreen and offline delivery.

by taogeo1 installs1 stars

Join video meetings as a voice bot, visual avatar, or avatar with live screen sharing.

by johnpatternai22 installs8 stars

Tests whether you genuinely understand something or just recognize it — exposes the gaps in your mental model.

by deciqai1 installs2 stars

Map business units on a growth-share grid to see which fund the portfolio, which burn cash, and where to act.

by deciqai1 installs2 stars

Prioritize growth directions with a 2×2 risk framework — pick one bet and commit.

by deciqai2 installs2 stars

More from thcjp

Browse all skills

Generate and process images, videos, or audio by routing each request to an appropriate CLI model.

by dlazy

Routes prompts to an appropriate CLI model for speech, dialogue, music, sound effects, or voice cloning.

by dlazy

Query and manage Pipedrive deals, contacts, organizations, and activities via a managed OAuth proxy.

by thcjp

Query and manage Linear work items through GraphQL with managed OAuth authentication.

by thcjp

Search Jira Cloud and manage issues, projects, comments, assignments, and workflow transitions.

by thcjp

常见办公流程自动化中枢,覆盖文档处理、数据整理、邮件管理、日程协调、报表生成与工作流编排。 聚焦批量操作容错、格式保真、PII 脱敏、模板复用四大痛点,让繁琐办公一键稳妥完成。 核心能力: - 文档批处理:Word/PDF/Excel/PPT 批量生成、转换、合并拆分,含失败隔离与重试 - 数据整理:清洗、转换、...

by thcjp3 installs1 stars