Turn China 3C launch inputs into executable routes, messaging, channel actions, risk checks, and review decisions.
Design & media
豆包图片生成-免费版
Try it轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
What it does
**功能说明**: 本技能涵盖 中文交互、与基础提示词、化工作流场景 等核心能力。
The skill document
功能说明: 本技能涵盖 中文交互、与基础提示词、化工作流场景 等核心能力。
豆包图片生成工具 - 免费版
概述
豆包图片生成免费版是一款面向个人用户的轻量级 AI 图片生成工具。它通过标准化的生成流程(确认需求 → 输入提示词 → 设置比例 → 生成 → 截图确认 → 下载保存),帮助用户快速将创意想法转化为视觉作品。
免费版聚焦核心生成场景:单张图片生成、基础比例选择、生成结果确认与下载。配置简单,适合以下用户:
- 个人用户快速生成创意图片
- 社交媒体创作者制作配图
- 设计师快速预览设计灵感
- AI 绘图初学者入门体验
免费版限制:单次生成 1 张图片,默认 3:4 比例,不支持批量生成、多比例输出、风格预设、提示词增强等高级能力。如需这些能力,请使用 PRO 版本。
核心能力
能力清单
| 能力 | 描述 | 免费版 |
|---|---|---|
| 单图生成 | 生成一张 AI 图片 | 支持 |
| 提示词输入 | 自定义提示词 | 支持 |
| 比例选择 | 选择图片比例 | 支持(3:4 默认) |
| 截图确认 | 生成后截图供用户选择 | 支持 |
| 图片下载 | 下载原图到本地 | 支持 |
| 简易提示词优化 | 基础提示词建议 | 支持 |
| 批量生成 | 多图同时生成 | 不支持 |
| 多比例输出 | 同时生成多比例 | 不支持 |
| 风格预设 | 预设风格模板 | 不支持 |
| 提示词增强 | AI 增强提示词 | 不支持 |
| 参考图生成 | 基于参考图生成 | 不支持 |
| 工作流自动化 | 批量自动化 | 不支持 |
输出: 返回能力清单的执行结果,包含操作状态和输出数据。
工作流程
询问用户生成需求
↓
用户确认提示词与比例
↓
输入提示词到生成页面
↓
设置图片比例(默认 3:4)
↓
点击生成按钮
↓
等待生成完成
↓
截图 4 张候选图发给用户
↓
用户选择并确认
↓
下载图片到本地
↓
复制到指定目录
输出: 返回工作流程的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
生成流程关键步骤
- 需求确认:先询问用户想要什么样的图片
- 提示词输入:用户确认后输入提示词
- 比例设置:默认 3:4,用户可选其他比例
- 生成触发:点击发送按钮(向上箭头),不按回车
- 结果截图:生成完成后立即截 4 张图
- 用户选择:通过 message 工具发给用户选择
- 确认下载:用户选好后点开大图确认
- 保存图片:点击下载原图保存
- 复制到目标目录:复制到指定文件夹
输出: 返回生成流程关键步骤的执行结果,包含操作状态和输出数据。 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:轻量级、图片生成工具、支持单图生成与基、适合个人用户快速、创作视觉内容、豆包图片生成免费、为个人用户提供轻、量化的、图片生成能力、核心能力、单张图片生成、按提示词创作、基础比例选择、生成结果截图确认、图片下载与保存等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
核心功能执行
执行核心功能执行操作,使用input_params参数进行配置。
输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
使用场景
场景 1:社交媒体配图创作
小张需要为社交媒体帖子生成一张配图。
操作步骤:
- Agent 询问:「您想要什么样的图片?有什么提示词要求?」
- 用户回答:「想要一张温馨的咖啡店场景,暖色调」
- Agent 输入提示词,设置 3:4 比例
- 生成完成后截图 4 张候选图
- 通过 message 工具发给用户选择
- 用户选择后下载保存
示例交互:
Agent: 您想要什么样的图片?有什么提示词要求?
用户: 想要一张温馨的咖啡店场景,暖色调
Agent: 好的,我将为您生成一张温馨咖啡店场景的图片,比例 3:4
[生成中...]
Agent: 已生成 4 张候选图,请选择您喜欢的一张
[发送 4 张截图]
用户: 我选第二张
Agent: 好的,已为您下载第二张图片并保存
场景 2:设计灵感预览
小李是设计师,希望快速预览某个设计概念。
操作步骤:
- Agent 询问需求
- 用户提供设计概念提示词
- Agent 生成图片
- 设计师查看候选图获取灵感
示例提示词:
提示词:现代简约风格客厅,大面积落地窗,木质地板,米色沙发,绿植点缀,自然光照明亮
比例:3:4
场景 3:学习 AI 绘图入门
小王想学习 AI 绘图,从简单的提示词开始尝试。
操作步骤:
- Agent 询问想要什么样的图片
- 用户输入简单提示词(如「一只可爱的橘猫」)
- Agent 给出提示词优化建议
- 生成图片并展示结果
示例提示词优化:
原始提示词:一只可爱的橘猫
优化建议:一只毛茸茸的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调,3:4 比例
不适用场景
以下场景豆包图片生成-免费版不适合处理:
- 3D建模和动画制作
- 照片级写实渲染
- 手绘原创插画
触发条件
需要设计创作、UI设计、海报制作、品牌视觉时使用。不适用于非本工具能力范围的需求。
快速开始
领先步:需求确认
收到任务后,领先步必须是询问用户:
Agent: 您想要生成什么样的图片?
- 主题内容是什么?
- 风格偏好(写实/卡通/油画等)?
- 比例要求(默认 3:4)?
- 其他特殊要求?
第二步:输入提示词
用户确认需求后,输入提示词到生成页面:
[打开豆包 AI 创作页面]
[输入用户确认的提示词]
[设置比例为 3:4(或用户指定比例)]
第三步:生成图片
点击发送按钮(向上箭头)触发生成:
[点击发送按钮 - 不要按回车]
[等待图片生成完成]
第四步:截图与选择
生成完成后立即截图 4 张候选图:
# 示例
# 通过 message 工具发送图片给用户选择
message --image /tmp/candidate-1.jpg --text "候选图 1"
message --image /tmp/candidate-2.jpg --text "候选图 2"
message --image /tmp/candidate-3.jpg --text "候选图 3"
message --image /tmp/candidate-4.jpg --text "候选图 4"
第五步:下载与保存
用户选择后,点开大图确认并下载:
# 下载用户选择的图片
# 复制到指定目录
cp /tmp/selected-image.png /target/directory/
配置示例
生成参数说明
| 参数 | 类型 | 默认值 | 说明 |
|---|---|---|---|
| 提示词 | 字符串 | 必需 | 描述要生成的图片内容 |
| 比例 | 字符串 | 3:4 | 图片宽高比 |
| 数量 | 整数 | 4 | 候选图数量 |
| 保存路径 | 字符串 | /tmp/ | 下载保存目录 |
支持的比例
免费版支持以下比例:
| 比例 | 适用场景 |
|---|---|
| 3:4(默认) | 竖版社交媒体 |
| 1:1 | 方形头像 |
| 4:3 | 横版配图 |
| 16:9 | 宽屏壁纸 |
提示词建议格式
[主体描述] + [风格] + [色调] + [细节] + [比例]
示例:
一只毛茸茸的橘猫(主体)
写实风格(风格)
暖色调(色调)
坐在窗台上 阳光洒在身上(细节)
3:4 比例
优选实践
1. 提示词撰写技巧
# 推荐:详细具体
一只可爱的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调
# 不推荐:过于简单
猫
2. 比例选择建议
| 用途 | 推荐比例 |
|---|---|
| 朋友圈/小红书 | 3:4 |
| 头像 | 1:1 |
| 公众号配图 | 4:3 |
| 手机壁纸 | 9:16 |
3. 生成流程规范
- 必须先询问用户需求,不要直接生成
- 用户确认后再输入提示词
- 点击发送按钮(向上箭头),不要按回车
- 等待图片完全生成后再截图
- 用户选好后要点开大图确认
- 用户确认后才能下载保存
- 每步必须拿到结果才能进行下一步
4. 截图与发送规范
- 截图必须用 message 工具发送图片给用户
- 不要使用虚拟路径
- 截图路径使用实际路径
常见问题
Q1:为什么必须先询问用户?
A: 询问用户需求可以:
- 明确生成方向,避免浪费
- 了解用户的风格偏好
- 确认比例要求
- 提升用户满意度
Q2:点击发送还是按回车?
A: 必须点击发送按钮(向上的箭头),不要按回车。按回车可能导致提示词格式错误。
Q3:生成的图片不满意怎么办?
A: 可以:
- 重新生成(调整提示词)
- 从 4 张候选图中选择最接近的
- 优化提示词后再生成
Q4:免费版支持哪些比例?
A: 支持常见比例:3:4、1:1、4:3、16:9。默认使用 3:4。如需更多比例或同时输出多比例,请使用 PRO 版本。
Q5:能否批量生成多张图片?
A: 免费版仅支持单次生成。如需批量生成,请使用 PRO 版本。
Q6:图片保存在哪里?
A: 默认保存到 /tmp/ 目录。建议复制到指定目录长期保存:
cp /tmp/generated-image.png /your/directory/
Q7:能否使用参考图生成?
A: 免费版仅支持文本提示词生成。如需基于参考图生成,请使用 PRO 版本。
依赖说明
运行环境
- Agent 平台:支持 SKILL.md 规范的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- 操作系统:Windows / macOS / Linux
- 浏览器:需要浏览器访问豆包 AI 创作页面
- 网络:需要网络连接(访问豆包服务)
依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 | 版本要求 |
|---|---|---|---|---|
| 浏览器 | 应用 | 必需 | 系统自带 | Chrome 100+ |
| message | 平台工具 | 必需 | Skill 平台安装 | - |
| 豆包账号 | 服务 | 必需 | 豆包平台注册 | - |
| LLM API | API | 必需 | 由 Agent 内置 LLM 提供 | - |
环境准备
# 验证浏览器
google-chrome --version
# 验证 message 工具
which message
# 验证工作区目录
ls $HOME/.skill-platform/workspace/
API Key 配置
免费版需要以下配置:
| 配置项 | 环境变量 | 用途 | 获取方式 |
|---|---|---|---|
| 豆包账号 | 浏览器登录 | 访问豆包 AI 服务 | 豆包平台注册 |
| Skill 平台 Token | 平台配置 | 平台认证 | Skill 平台控制台 |
# 本技能的核心实现逻辑
# 请参考上方使用说明进行配置和调用
echo "implementation_ready"
可用性分类
- 分类:MD+EXEC(Markdown 指令 + 命令行执行 + 浏览器自动化)
- 说明:通过自然语言指令驱动 Agent 操作浏览器完成图片生成
- 离线可用:否(需要网络访问豆包服务)
- 隐私等级:中(提示词需上传至豆包服务)
版本说明
- 当前版本:1.0.0
- 版本类型:FREE(免费版)
- 升级路径:如需批量生成、多比例输出、风格预设、提示词增强、参考图生成等能力,请使用
doubao-image-gen-tool-pro
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
已知限制
- 需LLM支持,无LLM环境不可用
- 复杂业务场景建议结合人工经验判断
- 执行效率受模型能力与网络环境影响
示例
基本用法
输出:返回执行结果,包含操作状态和输出数据
用户: 执行核心功能
Skill: 正在执行核心功能...
Skill: 执行完成,结果如下: 操作成功
安全注意事项
| 风险类型 | 防范措施 |
|---|---|
| API密钥泄露 | 通过环境变量配置,禁止硬编码到代码或配置文件中 |
| 命令执行风险 | 仅执行白名单命令,避免拼接用户输入到命令行参数中 |
| 网络通信安全 | 使用HTTPS协议,验证SSL证书有效性 |
| 敏感数据暴露 | 输出结果中不包含密钥、令牌等敏感信息 |
使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。
核心功能
- 自动化执行: 基于指令驱动的自动化流程
- 文件处理: 支持多种文件格式的读取、解析和写入操作
- API集成: 通过标准化接口调用外部服务并处理响应
- 命令执行: 在安全沙箱中执行系统命令并收集结果
- 信息检索: 快速搜索和过滤目标数据
核心功能
- 自动化执行: 基于指令驱动的自动化流程
- 文件处理: 支持多种文件格式的读取、解析和写入操作
- API集成: 通过标准化接口调用外部服务并处理响应
- 命令执行: 在安全沙箱中执行系统命令并收集结果
- 信息检索: 快速搜索和过滤目标数据
Related skills
Convert Word, PDF or PPT into browser-ready HTML slides with step animations, fullscreen and offline delivery.
Join video meetings as a voice bot, visual avatar, or avatar with live screen sharing.
Tests whether you genuinely understand something or just recognize it — exposes the gaps in your mental model.
Map business units on a growth-share grid to see which fund the portfolio, which burn cash, and where to act.
Prioritize growth directions with a 2×2 risk framework — pick one bet and commit.
More from thcjp
Browse all skillsGenerate and process images, videos, or audio by routing each request to an appropriate CLI model.
Routes prompts to an appropriate CLI model for speech, dialogue, music, sound effects, or voice cloning.
Query and manage Pipedrive deals, contacts, organizations, and activities via a managed OAuth proxy.
Query and manage Linear work items through GraphQL with managed OAuth authentication.
Search Jira Cloud and manage issues, projects, comments, assignments, and workflow transitions.
常见办公流程自动化中枢,覆盖文档处理、数据整理、邮件管理、日程协调、报表生成与工作流编排。 聚焦批量操作容错、格式保真、PII 脱敏、模板复用四大痛点,让繁琐办公一键稳妥完成。 核心能力: - 文档批处理:Word/PDF/Excel/PPT 批量生成、转换、合并拆分,含失败隔离与重试 - 数据整理:清洗、转换、...