本文档由 AI 自动翻译。如有任何不准确之处,请参考 英文原版。每个 Dify Cloud 套餐都包含一定数量的 AI 消息额度,可用于调用 Dify 托管的受支持模型。无需先添加自己的 API Key,即可直接使用不同模型供应商的模型,开始构建和测试应用。 使用 AI 消息额度运行应用时,额度会从工作空间的共享额度中扣除。这包括在编辑器、已发布的 Web 应用、服务 API 中发起的运行,以及由触发器启动的运行。
了解 AI 消息额度的消耗方式
受支持的模型运行时,工作空间可能消耗 AI 消息额度。常见场景包括:- 运行使用大语言模型的应用,无论模型是直接配置在聊天助手、文本生成应用或 Agent 应用中,还是通过 Workflow 或 Chatflow 的 LLM、问题分类器、参数提取器或 Agent 节点运行。
- 在应用编辑器中使用 AI 辅助生成功能,创建或修改提示词、代码、结构化输出配置,或 Workflow 和 Chatflow 草稿。
- 索引或搜索知识库,此类操作可能运行嵌入模型来执行索引或向量检索、运行大语言模型从源文档生成问答分段,或在启用重排序时运行重排序模型。
- 在应用中转录语音输入或生成音频输出,分别使用语音转文字模型和文字转语音模型。
比较模型额度消耗
每次运行模型时,都会按以下标准消耗额度:OpenAI
OpenAI
- 25 AI 消息额度:
gpt-5.6-sol、gpt-5.5。 - 20 AI 消息额度:
gpt-4。 - 15 AI 消息额度:
gpt-5.6-terra、gpt-5.4。 - 10 AI 消息额度:
gpt-5.2、gpt-4o、gpt-4o-transcribe-diarize、gpt-4o-transcribe、whisper-1、gpt-4o-mini-tts-2025-12-15、tts-1-hd、tts-1。 - 5 AI 消息额度:
gpt-5.6-luna、gpt-5.4-mini、gpt-5、gpt-5.1、gpt-4.1、o3-mini、o4-mini、gpt-4o-mini-transcribe-2025-12-15、gpt-4o-mini-transcribe、text-embedding-3-small、text-embedding-3-large、text-embedding-ada-002。 - 1 AI 消息额度:
gpt-5-mini、gpt-4.1-mini、gpt-4o-mini、gpt-3.5-turbo。
Anthropic
Anthropic
- 20 AI 消息额度:
Claude Opus 4.7、Claude Opus 4.6、Claude Opus 4.5。 - 10 AI 消息额度:
Claude Sonnet 4.6、Claude Sonnet 4.5。 - 5 AI 消息额度:
Claude Haiku 4.5。
Gemini
Gemini
- 10 AI 消息额度:
Gemini 3.5 Flash、Gemini 3.1 Pro-Preview。 - 5 AI 消息额度:
gemini-3.7-flash、gemini-embedding-001、gemini-embedding-2。 - 3 AI 消息额度:
Gemini 3 Flash-Preview。 - 1 AI 消息额度:
Gemini 3.5 Flash-Lite、Gemini 3.1 Flash-Lite-Preview、Gemini 3.1 Flash-Lite、Gemini 2.5 Flash、Gemini 2.0 Flash、Gemini 2.0 Flash-Lite。
xAI
xAI
- 20 AI 消息额度:
grok-4.5、grok-4.6。 - 10 AI 消息额度:
grok-4.3。
Tongyi
Tongyi
- 20 AI 消息额度:
qwen3-tts-flash。 - 10 AI 消息额度:
qwen3.7-max、qwen3.7-max-preview、qwen3.6-max-preview、qwen3-max、qwen3-max-preview、qwen-max、qwen3.6-plus、qwen-plus、qwen-plus-latest、qwen3.5-omni-plus、qvq-max。 - 5 AI 消息额度:
qwen3.5-plus、qwen3.6-flash、qwen-flash、qwq-plus、qwen3.5-omni-flash、qwen3-vl-plus、qwen-vl-max、text-embedding-v3、text-embedding-v4。 - 1 AI 消息额度:
qwen3.7-plus、qwen3.5-flash、qwen-turbo、qwen-long-latest、qwen-long-2025-01-25、qwen3-vl-flash、qwen-vl-plus、qwen3-rerank。
无法通过 AI 消息额度使用上方未列出的模型。添加自己的 API Key 后即可使用这些模型。
查看 AI 消息额度
工作空间名称下方会显示剩余的 AI 消息额度。点击该数值,即可进入 集成 > 模型供应商 查看使用详情。 不同套餐包含的 AI 消息额度如下:升级到 Professional 或 Team 后,Dify 会先使用新套餐的 AI 消息额度,再使用剩余的 Sandbox 额度。单次模型运行无法合并使用这两部分额度。
设置使用优先级
对于支持 AI 消息额度的模型供应商,添加首个 API Key 后,Dify 会自动优先使用该 API Key。若要调整顺序,前往 集成 > 模型供应商,点击供应商卡片上的 配置,然后设置 使用优先级:- AI 消息额度优先:请求会先使用 AI 消息额度,额度用尽后改用所选 API Key。若剩余额度低于模型单次运行所需的额度,将优先级改为 API Key。
- API Key 优先:请求会使用所选 API Key。如果无法通过该 API Key 发送请求,则使用可用的 AI 消息额度。
如果请求已经通过 API Key 发出但执行失败,Dify 不会改用 AI 消息额度重试。修复 API Key 或模型供应商的问题,或在重试前将优先级改为 AI 消息额度。