> ## Documentation Index
> Fetch the complete documentation index at: https://dify-6c0370d8-agent-add-ai-credits-doc.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# AI 消息额度

> 了解工作空间中的 AI 消息额度如何运作，包括各模型的额度消耗和使用优先级

> 本文档由 AI 自动翻译。如有任何不准确之处，请参考 [英文原版](/en/cloud/use-dify/workspace/ai-credits)。

每个 Dify Cloud 套餐都包含一定数量的 AI 消息额度，可用于调用 Dify 托管的受支持模型。无需先添加自己的 API Key，即可直接使用不同模型供应商的模型，开始构建和测试应用。

使用 AI 消息额度运行应用时，额度会从工作空间的共享额度中扣除。这包括在编辑器、已发布的 Web 应用、服务 API 中发起的运行，以及由触发器启动的运行。

## 了解 AI 消息额度的消耗方式

受支持的模型运行时，工作空间可能消耗 AI 消息额度。常见场景包括：

* **运行使用大语言模型的应用**，无论模型是直接配置在聊天助手、文本生成应用或 Agent 应用中，还是通过 Workflow 或 Chatflow 的 LLM、问题分类器、参数提取器或 Agent 节点运行。
* **在应用编辑器中使用 AI 辅助生成功能**，创建或修改提示词、代码、结构化输出配置，或 Workflow 和 Chatflow 草稿。
* **索引或搜索知识库**，此类操作可能运行嵌入模型来执行索引或向量检索、运行大语言模型从源文档生成问答分段，或在启用重排序时运行重排序模型。
* **在应用中转录语音输入或生成音频输出**，分别使用语音转文字模型和文字转语音模型。

每次发起应用请求、运行 Workflow 应用或执行其他任务时，AI 消息额度的总消耗等于所有模型运行所需额度之和。每个模型的额度消耗固定，不受输入或输出长度影响。

例如，运行一次 Workflow 应用时，系统调用一个每次消耗 5 AI 消息额度的大语言模型 3 次来分析 3 条客户评论，然后再调用 1 次来总结结果。这次运行共消耗 20 AI 消息额度。

## 比较模型额度消耗

每次运行模型时，都会按以下标准消耗额度：

<AccordionGroup>
  <Accordion title="OpenAI">
    * **25 AI 消息额度**：`gpt-5.6-sol`、`gpt-5.5`。
    * **20 AI 消息额度**：`gpt-4`。
    * **15 AI 消息额度**：`gpt-5.6-terra`、`gpt-5.4`。
    * **10 AI 消息额度**：`gpt-5.2`、`gpt-4o`、`gpt-4o-transcribe-diarize`、`gpt-4o-transcribe`、`whisper-1`、`gpt-4o-mini-tts-2025-12-15`、`tts-1-hd`、`tts-1`。
    * **5 AI 消息额度**：`gpt-5.6-luna`、`gpt-5.4-mini`、`gpt-5`、`gpt-5.1`、`gpt-4.1`、`o3-mini`、`o4-mini`、`gpt-4o-mini-transcribe-2025-12-15`、`gpt-4o-mini-transcribe`、`text-embedding-3-small`、`text-embedding-3-large`、`text-embedding-ada-002`。
    * **1 AI 消息额度**：`gpt-5-mini`、`gpt-4.1-mini`、`gpt-4o-mini`、`gpt-3.5-turbo`。
  </Accordion>

  <Accordion title="Anthropic">
    * **20 AI 消息额度**：`Claude Opus 4.7`、`Claude Opus 4.6`、`Claude Opus 4.5`。
    * **10 AI 消息额度**：`Claude Sonnet 4.6`、`Claude Sonnet 4.5`。
    * **5 AI 消息额度**：`Claude Haiku 4.5`。
  </Accordion>

  <Accordion title="Gemini">
    * **10 AI 消息额度**：`Gemini 3.5 Flash`、`Gemini 3.1 Pro-Preview`。
    * **5 AI 消息额度**：`gemini-3.7-flash`、`gemini-embedding-001`、`gemini-embedding-2`。
    * **3 AI 消息额度**：`Gemini 3 Flash-Preview`。
    * **1 AI 消息额度**：`Gemini 3.5 Flash-Lite`、`Gemini 3.1 Flash-Lite-Preview`、`Gemini 3.1 Flash-Lite`、`Gemini 2.5 Flash`、`Gemini 2.0 Flash`、`Gemini 2.0 Flash-Lite`。
  </Accordion>

  <Accordion title="xAI">
    * **20 AI 消息额度**：`grok-4.5`、`grok-4.6`。
    * **10 AI 消息额度**：`grok-4.3`。
  </Accordion>

  <Accordion title="Tongyi">
    * **20 AI 消息额度**：`qwen3-tts-flash`。
    * **10 AI 消息额度**：`qwen3.7-max`、`qwen3.7-max-preview`、`qwen3.6-max-preview`、`qwen3-max`、`qwen3-max-preview`、`qwen-max`、`qwen3.6-plus`、`qwen-plus`、`qwen-plus-latest`、`qwen3.5-omni-plus`、`qvq-max`。
    * **5 AI 消息额度**：`qwen3.5-plus`、`qwen3.6-flash`、`qwen-flash`、`qwq-plus`、`qwen3.5-omni-flash`、`qwen3-vl-plus`、`qwen-vl-max`、`text-embedding-v3`、`text-embedding-v4`。
    * **1 AI 消息额度**：`qwen3.7-plus`、`qwen3.5-flash`、`qwen-turbo`、`qwen-long-latest`、`qwen-long-2025-01-25`、`qwen3-vl-flash`、`qwen-vl-plus`、`qwen3-rerank`。
  </Accordion>
</AccordionGroup>

<Note>
  无法通过 AI 消息额度使用上方未列出的模型。[添加自己的 API Key](/zh/cloud/use-dify/workspace/model-providers#使用自己的-api-key) 后即可使用这些模型。
</Note>

## 查看 AI 消息额度

工作空间名称下方会显示剩余的 AI 消息额度。点击该数值，即可进入 **集成** > **模型供应商** 查看使用详情。

不同套餐包含的 AI 消息额度如下：

| 套餐           | 包含的 AI 消息额度 | 额度更新  |
| :----------- | :---------- | :---- |
| Sandbox      | 200         | 一次性发放 |
| Professional | 5,000       | 每月    |
| Team         | 10,000      | 每月    |

<Note>
  升级到 Professional 或 Team 后，Dify 会先使用新套餐的 AI 消息额度，再使用剩余的 Sandbox 额度。单次模型运行无法合并使用这两部分额度。
</Note>

## 设置使用优先级

对于支持 AI 消息额度的模型供应商，添加首个 API Key 后，Dify 会自动优先使用该 API Key。若要调整顺序，前往 **集成** > **模型供应商**，点击供应商卡片上的 **配置**，然后设置 **使用优先级**：

* **AI 消息额度优先**：请求会先使用 AI 消息额度，额度用尽后改用所选 API Key。若剩余额度低于模型单次运行所需的额度，将优先级改为 **API Key**。
* **API Key 优先**：请求会使用所选 API Key。如果无法通过该 API Key 发送请求，则使用可用的 AI 消息额度。

<Note>
  如果请求已经通过 API Key 发出但执行失败，Dify 不会改用 AI 消息额度重试。修复 API Key 或模型供应商的问题，或在重试前将优先级改为 **AI 消息额度**。
</Note>
