LLAiGateway 首页模型广场与价格
USD 基础价格,每百万 Token 计价;实际费用受分组倍率影响。
DeepSeek V4.1 Flash 福利版
模型 ID:deepseek-flash-free
厂商:DeepSeek
DeepSeek 推出的 DeepSeek V4.1 Flash,1M 上下文、384K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、流式输出。兼容 Anthropic Messages / OpenAI Responses 协议,替换 Base URL 即可接入。
上下文窗口:1000000 tokens;最大输出:384000 tokens
reasoning:支持 stream:支持 tools:支持 vision:支持 | 计费项 | 基础价格 USD | deespeek ×0.0800 |
|---|
| 输入 / 1M tokens | $0.0000 | $0.0000 |
| 输出 / 1M tokens | $0.0000 | $0.0000 |
| 缓存读取 / 1M tokens | $0.0000 | $0.0000 |
| 缓存写入 / 1M tokens | $0.0000 | $0.0000 |
| 每请求 | $0.0000 | $0.0000 |
查看模型详情开始接入DeepSeek V4.1 Flash
模型 ID:deepseek-v4.1-flash
厂商:DeepSeek
DeepSeek 推出的 DeepSeek V4.1 Flash,1M 上下文、384K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、流式输出。兼容 Anthropic Messages / OpenAI Responses 协议,替换 Base URL 即可接入。
上下文窗口:1000000 tokens;最大输出:384000 tokens
reasoning:支持 stream:支持 tools:支持 vision:支持 | 计费项 | 基础价格 USD | deespeek ×0.0800 |
|---|
| 输入 / 1M tokens | $2.0000 | $0.1600 |
| 输出 / 1M tokens | $8.0000 | $0.6400 |
| 缓存读取 / 1M tokens | $0.0000 | $0.0000 |
| 缓存写入 / 1M tokens | $0.0400 | $0.0032 |
| 每请求 | $0.0000 | $0.0000 |
上下文动态计费档位
按真实输入总量选择最高匹配下限,整次请求应用该档价格,不是累进计价。
分时倍率
UTC 固定偏移 480 分钟;按请求接入时间锁定。
查看模型详情开始接入gpt-6-luna
模型 ID:gpt-6-luna
厂商:OpenAI
OpenAI(OpenAI, Inc.)是一家美国人工智能(AI)组织,总部位于加利福尼亚州旧金山。其目标是开发“安全且有益”的通用人工智能(AGI),并将其定义为“在大多数具有经济价值的工作中表现优于人类的高度自主系统”。 作为当前人工智能热潮中的领先机构,OpenAI 因其 GPT 系列大型语言模型、DALL·E 系列文生图模型,以及名为 Sora 的文生视频模型而广为人知。其于 2022 年 11 月发布的 ChatGPT 被认为推动了生成式人工智能(Generative AI)在全球范围内的广泛关注与快速发展。
上下文窗口:0 tokens;最大输出:32768 tokens
reasoning:支持 stream:支持 tools:支持 vision:支持 | 计费项 | 基础价格 USD | gpt-Azure ×0.8000 |
|---|
| 输入 / 1M tokens | $0.1000 | $0.0800 |
| 输出 / 1M tokens | $0.5000 | $0.4000 |
| 缓存读取 / 1M tokens | $0.0100 | $0.0080 |
| 缓存写入 / 1M tokens | $0.1250 | $0.1000 |
| 每请求 | $0.0000 | $0.0000 |
上下文动态计费档位
按真实输入总量选择最高匹配下限,整次请求应用该档价格,不是累进计价。
分时倍率
UTC 固定偏移 480 分钟;按请求接入时间锁定。
查看模型详情开始接入GPT-6.1 Sol
模型 ID:gpt-6.1-sol
厂商:OpenAI
OpenAI 推出的 GPT-6.1 Sol,1.05M 上下文、128K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、文件输入、流式输出、联网搜索。兼容 Anthropic Messages / OpenAI Responses 协议,替换 Base URL 即可接入。
上下文窗口:1050000 tokens;最大输出:128000 tokens
reasoning:支持 stream:支持 tools:支持 vision:支持 | 计费项 | 基础价格 USD | gpt-pro 不降智 ×0.2700 |
|---|
| 输入 / 1M tokens | $2.0000 | $0.5400 |
| 输出 / 1M tokens | $10.0000 | $2.7000 |
| 缓存读取 / 1M tokens | $0.1000 | $0.0270 |
| 缓存写入 / 1M tokens | $2.5000 | $0.6750 |
| 每请求 | $0.0000 | $0.0000 |
上下文动态计费档位
按真实输入总量选择最高匹配下限,整次请求应用该档价格,不是累进计价。
长上下文 1 · 输入 ≥ 272001 tokens
输入 / 1M:$4.000000
输出 / 1M:$15.000000
缓存读取 / 1M:$0.200000
缓存写入 / 1M:$2.500000
每请求:$0.000000
分时倍率
UTC 固定偏移 480 分钟;按请求接入时间锁定。
查看模型详情开始接入