LLAiGateway 首页

模型广场与价格

USD 基础价格,每百万 Token 计价;实际费用受分组倍率影响。

DeepSeek V4.1 Flash 福利版

模型 ID:deepseek-flash-free

厂商:DeepSeek

DeepSeek 推出的 DeepSeek V4.1 Flash,1M 上下文、384K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、流式输出。兼容 Anthropic Messages / OpenAI Responses 协议,替换 Base URL 即可接入。

上下文窗口:1000000 tokens;最大输出:384000 tokens

reasoning:支持 stream:支持 tools:支持 vision:支持
计费项基础价格 USDdeespeek ×0.0800
输入 / 1M tokens$0.0000$0.0000
输出 / 1M tokens$0.0000$0.0000
缓存读取 / 1M tokens$0.0000$0.0000
缓存写入 / 1M tokens$0.0000$0.0000
每请求$0.0000$0.0000
查看模型详情开始接入

DeepSeek V4.1 Flash

模型 ID:deepseek-v4.1-flash

厂商:DeepSeek

DeepSeek 推出的 DeepSeek V4.1 Flash,1M 上下文、384K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、流式输出。兼容 Anthropic Messages / OpenAI Responses 协议,替换 Base URL 即可接入。

上下文窗口:1000000 tokens;最大输出:384000 tokens

reasoning:支持 stream:支持 tools:支持 vision:支持
计费项基础价格 USDdeespeek ×0.0800
输入 / 1M tokens$2.0000$0.1600
输出 / 1M tokens$8.0000$0.6400
缓存读取 / 1M tokens$0.0000$0.0000
缓存写入 / 1M tokens$0.0400$0.0032
每请求$0.0000$0.0000

上下文动态计费档位

按真实输入总量选择最高匹配下限,整次请求应用该档价格,不是累进计价。

分时倍率

UTC 固定偏移 480 分钟;按请求接入时间锁定。

查看模型详情开始接入

gpt-6-luna

模型 ID:gpt-6-luna

厂商:OpenAI

OpenAI(OpenAI, Inc.)是一家美国人工智能(AI)组织,总部位于加利福尼亚州旧金山。其目标是开发“安全且有益”的通用人工智能(AGI),并将其定义为“在大多数具有经济价值的工作中表现优于人类的高度自主系统”。 作为当前人工智能热潮中的领先机构,OpenAI 因其 GPT 系列大型语言模型、DALL·E 系列文生图模型,以及名为 Sora 的文生视频模型而广为人知。其于 2022 年 11 月发布的 ChatGPT 被认为推动了生成式人工智能(Generative AI)在全球范围内的广泛关注与快速发展。

上下文窗口:0 tokens;最大输出:32768 tokens

reasoning:支持 stream:支持 tools:支持 vision:支持
计费项基础价格 USDgpt-Azure ×0.8000
输入 / 1M tokens$0.1000$0.0800
输出 / 1M tokens$0.5000$0.4000
缓存读取 / 1M tokens$0.0100$0.0080
缓存写入 / 1M tokens$0.1250$0.1000
每请求$0.0000$0.0000

上下文动态计费档位

按真实输入总量选择最高匹配下限,整次请求应用该档价格,不是累进计价。

分时倍率

UTC 固定偏移 480 分钟;按请求接入时间锁定。

查看模型详情开始接入

GPT-6.1 Sol

模型 ID:gpt-6.1-sol

厂商:OpenAI

OpenAI 推出的 GPT-6.1 Sol,1.05M 上下文、128K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、文件输入、流式输出、联网搜索。兼容 Anthropic Messages / OpenAI Responses 协议,替换 Base URL 即可接入。

上下文窗口:1050000 tokens;最大输出:128000 tokens

reasoning:支持 stream:支持 tools:支持 vision:支持
计费项基础价格 USDgpt-pro 不降智 ×0.2700
输入 / 1M tokens$2.0000$0.5400
输出 / 1M tokens$10.0000$2.7000
缓存读取 / 1M tokens$0.1000$0.0270
缓存写入 / 1M tokens$2.5000$0.6750
每请求$0.0000$0.0000

上下文动态计费档位

按真实输入总量选择最高匹配下限,整次请求应用该档价格,不是累进计价。

长上下文 1 · 输入 ≥ 272001 tokens

输入 / 1M:$4.000000

输出 / 1M:$15.000000

缓存读取 / 1M:$0.200000

缓存写入 / 1M:$2.500000

每请求:$0.000000

分时倍率

UTC 固定偏移 480 分钟;按请求接入时间锁定。

查看模型详情开始接入