Skip to main content

Image Generation

Image Generation 让你的智能体在对话或工作流运行过程中,根据文本提示创建图像。

它做什么

此工具让智能体调用原生的 create_image 函数。Fetch Hive 在服务端针对图像生成服务执行该函数,从而避免对耗时较长的图像任务受到远程 MCP 超时限制。所使用的 API 取决于智能体的主要提供商:
  • OpenAI 智能体 — 路由到 OpenAI 的图像生成 API(gpt-image-2)。Fetch Hive 会强制将智能体的图像尺寸和质量设为 auto,以控制托管 LLM credit 的消耗。
  • xAI 智能体 — 路由到 Grok Imagine(grok-imagine-image-quality)。OpenAI 专有选项(尺寸、质量、背景等)会被忽略。
  • Gemini 智能体 — 通过 Vertex AI 将托管请求路由到 Gemini 2.5 Flash Image。目前尚不支持个人/BYOK 的 Gemini 图像生成。OpenAI 专有选项会被忽略。
  • 其他个人智能体 — 通过工作区的 OpenAI 提供商密钥来路由图像生成。
启用后,智能体可以在运行时生成一张或多张图像,并以永久资产 URL 的形式返回。 支持 托管个人 两种计费模式:
  • 托管 — 图像计入你工作区的托管 LLM credit 余额(不需要 API 密钥)。
  • 个人 — 使用并直接计费到你工作区自己的提供商密钥。OpenAI 和 xAI 智能体使用与其匹配的提供商密钥;其他个人智能体提供商使用工作区的 OpenAI 密钥来生成图像。目前尚不支持 Gemini 个人图像生成。

将工具添加到智能体

  1. 在编辑器中打开一个智能体。
  2. 点击工具提示为 Add MCP Tool or Sub Agent 的按钮。
  3. MCP Tools 中,点击 Image Generation
添加工具后,选中 Image Generation 节点以打开其设置面板。

配置

可用选项(向智能体公开)

智能体在调用该工具时控制以下参数:

输出

每张生成的图像会被上传到 R2 存储,并作为带有永久公开 URL 的资产记录返回。智能体会收到这些 URL,并可将其包含在响应中。 在调用图像提供商之前,Fetch Hive 会检查你的账户是否已达到套餐存储限制。如果已达到限制,该工具会返回错误,而不会生成新图像。

计费

  • OpenAI(gpt-image-2):按 token 计费。输入图像 token、输入文本 token 和输出 token 会被记录在完成中,并出现在你的用量仪表板中。
  • xAI(Grok Imagine):按图像计费,每张生成的图像采用固定费率。Token 字段被设为 0。
  • Gemini 图像模型(gemini-2.5-flash-imagegemini-3.1-flash-lite-imagegemini-3.1-flash-imagegemini-3-pro-image):通过 fetch-image-mcp 中的 Gemini Interactions API 进行托管 token 计费。目前尚不支持个人/BYOK 的 Gemini 图像生成。输入 token 和生成图像的输出 token 会记录在完成中,用于托管计费。

使用场景

  • 根据提示词生成产品 mockup 或插图草稿。
  • 在较长的研究或写作任务中创建支持性视觉素材。
  • 与 Vector Search 和 SERP 结合,生成图文丰富的报告。

备注

  • Image Generation 适用于所有受支持的 LLM 提供商(OpenAI、Anthropic、xAI、Gemini)。上下文和凭据通过一个短期 JWT 从 Fetch Hive 传递到图像服务。
  • 对于 LLM 提供商不是 OpenAI 或 xAI 的个人智能体,请在启用 Image Generation 之前配置一个 OpenAI 提供商密钥。目前尚不支持 Gemini 个人图像生成。
  • 智能体的图像生成会在模型发出 create_image 之后由 Fetch Hive 执行,因此长时间运行的生成不会受提供商远程 MCP 超时的限制。
  • 要从工作流步骤(而不是智能体)生成图像,请参阅 Image Generation 工作流步骤
  • 要在智能体中添加或移除工具,请参阅创建和配置

重复使用图片

生成的图片会立即显示,并可从使用此聊天中的文件再次选择。重复使用会为当前轮次明确选择现有 Asset;旧图片不会自动发送给模型。