Skip to main content
本文档由 AI 自动翻译。如有任何不准确之处,请参考 英文原版
每个 Dify Cloud 套餐都包含一定数量的 AI 消息额度,可用于调用 Dify 托管的受支持模型。无需先添加自己的 API Key,即可直接使用不同模型供应商的模型,开始构建和测试应用。 使用 AI 消息额度运行应用时,额度会从工作空间的共享额度中扣除。这包括在编辑器、已发布的 Web 应用、服务 API 中发起的运行,以及由触发器启动的运行。

了解 AI 消息额度的消耗方式

受支持的模型运行时,工作空间可能消耗 AI 消息额度。常见场景包括:
  • 运行使用大语言模型的应用,无论模型是直接配置在聊天助手、文本生成应用或 Agent 应用中,还是通过 Workflow 或 Chatflow 的 LLM、问题分类器、参数提取器或 Agent 节点运行。
  • 在应用编辑器中使用 AI 辅助生成功能,创建或修改提示词、代码、结构化输出配置,或 Workflow 和 Chatflow 草稿。
  • 索引或搜索知识库,此类操作可能运行嵌入模型来执行索引或向量检索、运行大语言模型从源文档生成问答分段,或在启用重排序时运行重排序模型。
  • 在应用中转录语音输入或生成音频输出,分别使用语音转文字模型和文字转语音模型。
每次发起应用请求、运行 Workflow 应用或执行其他任务时,AI 消息额度的总消耗等于所有模型运行所需额度之和。每个模型的额度消耗固定,不受输入或输出长度影响。 例如,运行一次 Workflow 应用时,系统调用一个每次消耗 5 AI 消息额度的大语言模型 3 次来分析 3 条客户评论,然后再调用 1 次来总结结果。这次运行共消耗 20 AI 消息额度。

比较模型额度消耗

每次运行模型时,都会按以下标准消耗额度:
  • 25 AI 消息额度gpt-5.6-solgpt-5.5
  • 20 AI 消息额度gpt-4
  • 15 AI 消息额度gpt-5.6-terragpt-5.4
  • 10 AI 消息额度gpt-5.2gpt-4ogpt-4o-transcribe-diarizegpt-4o-transcribewhisper-1gpt-4o-mini-tts-2025-12-15tts-1-hdtts-1
  • 5 AI 消息额度gpt-5.6-lunagpt-5.4-minigpt-5gpt-5.1gpt-4.1o3-minio4-minigpt-4o-mini-transcribe-2025-12-15gpt-4o-mini-transcribetext-embedding-3-smalltext-embedding-3-largetext-embedding-ada-002
  • 1 AI 消息额度gpt-5-minigpt-4.1-minigpt-4o-minigpt-3.5-turbo
  • 20 AI 消息额度Claude Opus 4.7Claude Opus 4.6Claude Opus 4.5
  • 10 AI 消息额度Claude Sonnet 4.6Claude Sonnet 4.5
  • 5 AI 消息额度Claude Haiku 4.5
  • 10 AI 消息额度Gemini 3.5 FlashGemini 3.1 Pro-Preview
  • 5 AI 消息额度gemini-3.7-flashgemini-embedding-001gemini-embedding-2
  • 3 AI 消息额度Gemini 3 Flash-Preview
  • 1 AI 消息额度Gemini 3.5 Flash-LiteGemini 3.1 Flash-Lite-PreviewGemini 3.1 Flash-LiteGemini 2.5 FlashGemini 2.0 FlashGemini 2.0 Flash-Lite
  • 20 AI 消息额度grok-4.5grok-4.6
  • 10 AI 消息额度grok-4.3
  • 20 AI 消息额度qwen3-tts-flash
  • 10 AI 消息额度qwen3.7-maxqwen3.7-max-previewqwen3.6-max-previewqwen3-maxqwen3-max-previewqwen-maxqwen3.6-plusqwen-plusqwen-plus-latestqwen3.5-omni-plusqvq-max
  • 5 AI 消息额度qwen3.5-plusqwen3.6-flashqwen-flashqwq-plusqwen3.5-omni-flashqwen3-vl-plusqwen-vl-maxtext-embedding-v3text-embedding-v4
  • 1 AI 消息额度qwen3.7-plusqwen3.5-flashqwen-turboqwen-long-latestqwen-long-2025-01-25qwen3-vl-flashqwen-vl-plusqwen3-rerank
无法通过 AI 消息额度使用上方未列出的模型。添加自己的 API Key 后即可使用这些模型。

查看 AI 消息额度

工作空间名称下方会显示剩余的 AI 消息额度。点击该数值,即可进入 集成 > 模型供应商 查看使用详情。 不同套餐包含的 AI 消息额度如下:
升级到 Professional 或 Team 后,Dify 会先使用新套餐的 AI 消息额度,再使用剩余的 Sandbox 额度。单次模型运行无法合并使用这两部分额度。

设置使用优先级

对于支持 AI 消息额度的模型供应商,添加首个 API Key 后,Dify 会自动优先使用该 API Key。若要调整顺序,前往 集成 > 模型供应商,点击供应商卡片上的 配置,然后设置 使用优先级
  • AI 消息额度优先:请求会先使用 AI 消息额度,额度用尽后改用所选 API Key。若剩余额度低于模型单次运行所需的额度,将优先级改为 API Key
  • API Key 优先:请求会使用所选 API Key。如果无法通过该 API Key 发送请求,则使用可用的 AI 消息额度。
如果请求已经通过 API Key 发出但执行失败,Dify 不会改用 AI 消息额度重试。修复 API Key 或模型供应商的问题,或在重试前将优先级改为 AI 消息额度
最后修改于 2026年8月28日