Model Plaza & Pricing Matrix
2026 最新大模型广场算力与价格全景矩阵
SuperFast API 直连官方模型广场(Model Plaza),汇聚全球 200+ 前沿旗舰与次世代未来模型。全系列统一按量计费,无套餐捆绑,支持高并发弹性调度与多源灾备保障。
支持模型总数
200+
涵盖 6 大精选分组与前瞻旗舰
平均首字响应延迟
< 280ms
跨洋高速专线直达
综合费率折扣
1 ~ 3 折
福利专区 $0.15/1M 起 · 永久有效
接口可用率 (SLA)
99.99%
多源智能灾备与高并发负载
LIVE PLAZA
官方直连模型广场 (Model Plaza) 实时在线
所有模型已在 Sub2API 官方服务中完成动态部署。支持随时在线检索模型详情、测试参数与费率、一键复制模型代号,享受最高优先级调度保障。
🌟
在模型广场查看 →
OpenAI 巅峰与次世代前瞻系列
旗舰基座| 模型代号 (Model ID) | 上下文窗口 | 输入价格 (每 1M Tokens) | 输出价格 (每 1M Tokens) | 计费模式 | 平均首字延迟 | 核心专长与典型场景 |
|---|---|---|---|---|---|---|
| gpt-6-astra 超前瞻旗舰 | 500K | $10.00 | $50.00 | 按量 Token | ~380ms | 次世代天花板旗舰,全模态超深度逻辑推演、自主智能体系统级调度与颠覆性知识创造 |
| gpt-5.6-sol 未来旗舰 | 256K | $5.00 | $30.00 | 按量 Token | ~320ms | 次世代全能大模型,复杂物理逻辑模拟、跨域多模态联合分析与工业级全栈编码 |
| gpt-5.5 | 256K | $5.00 | $30.00 | 按量 Token | ~310ms | 高阶长链推理架构,万行复杂工程代码协同与高等数理学术推导 |
| gpt-5.4 | 128K | $5.00 | $30.00 | 按量 Token | ~290ms | 行业通用全能基座,平衡低延迟毫秒级流式响应与极高推理泛化深度 |
| codex-auto-review 代码专精 | 128K | $5.00 | $30.00 | 按量 Token | ~300ms | 企业级代码安全自动审计、自动化漏洞扫描与大规模软件工程架构重构 |
| gpt-4o | 128K | $1.25 | $5.00 | 按量 Token | ~280ms | 全功能全模态主力,文本/视觉/数据图表综合处理,通用商业任务首选基石 |
| gpt-4o-mini | 128K | $0.075 | $0.30 | 按量 Token | ~160ms | 极低成本高并发利器,海量日志清洗、日常轻量问答与初级信息抽取 |
| o3-mini 深度思维 | 200K | $1.10 | $4.40 | 按量 Token | ~450ms | 深度思考强化学习模型,高难度编程算法竞赛与严谨数学逻辑推导 |
🧠
在模型广场查看 →
Anthropic Claude 满血系列
学术与编码巅峰| 模型代号 (Model ID) | 上下文窗口 | 输入价格 (每 1M Tokens) | 输出价格 (每 1M Tokens) | 计费模式 | 平均首字延迟 | 核心专长与典型场景 |
|---|---|---|---|---|---|---|
| claude-opus-5 终极智慧 | 300K | $5.00 | $25.00 | 按量 Token | ~350ms | Anthropic 终极智能巅峰,顶级科研论文写作、哲学深度推演与超长程自主 Agent |
| claude-opus-4-8 | 200K | $5.00 | $25.00 | 按量 Token | ~330ms | 深度严谨逻辑分析,金融复杂模型建模与高权威学术综述研判 |
| claude-opus-4-7 | 200K | $5.00 | $25.00 | 按量 Token | ~320ms | 全栈工程系统架构规划、复杂多文件项目代码协同与逻辑一致性校验 |
| claude-opus-4-6 | 200K | $5.00 | $25.00 | 按量 Token | ~310ms | 高确定性深度推理,法律严密条款推敲与多轮深度博弈决策 |
| claude-sonnet-4-6 编程首选 | 200K | $3.00 | $15.00 | 按量 Token | ~260ms | 编程实力与响应延迟的完美黄金平衡,Cursor、Cline 编程辅助神器 |
| claude-3-5-sonnet | 200K | $1.20 | $6.00 | 按量 Token | ~320ms | 全栈开发业界公认基准,强大代码生成、长文本解析与复杂指令遵循 |
| claude-3-5-haiku | 200K | $0.35 | $1.75 | 按量 Token | ~190ms | 超低延迟闪电响应,海量语料清洗与即时流式对话应用首选 |
⚡
在模型广场查看 →
xAI Grok 探索与深度思考系列
真实前沿| 模型代号 (Model ID) | 上下文窗口 | 输入费率 (每 1M) | 输出费率 (每 1M) | 单次费率 | 平均首字延迟 | 核心专长与典型场景 |
|---|---|---|---|---|---|---|
| grok-4.6 马斯克旗舰 | 256K | $2.00 | $6.00 | $2.00/次 | ~280ms | xAI 顶尖旗舰,前沿真实世界数据洞察,无说教,多维物理与前沿科技深度思辨 |
| grok-4.5 | 200K | $2.00 | $6.00 | $2.00/次 | ~270ms | 高智力深度探索模型,犀利洞察力与超强跨领域多角度推演 |
| grok-4.20-0309-reasoning 思维链 | 128K | $1.25 | $2.50 | $2.00/次 | ~390ms | 长思维链深度推理版本,数理逻辑强化、复杂策略推演与因果关系解构 |
| grok-4.20-0309-non-reasoning | 128K | $1.25 | $2.50 | $2.00/次 | ~190ms | 极速低延迟版本,高吞吐秒级流式吐字,适合实时对话与互动助手 |
| grok-imagine-image-quality 超写实生图 | - | - | - | $2.00/次 | ~1.8s | 工业级光影写实生图,细腻真实材质还原与艺术视觉冲击力 |
| grok-imagine-image-2.0 | - | - | - | $2.00/次 | ~1.5s | 次世代 Grok 视觉引擎,画质与构图全面升级,概念艺术与创意场景 |
| grok-imagine-image | - | - | - | $2.00/次 | ~1.2s | 极速文生图,前卫现代风格与高对比度概念图一键直出 |
💎
在模型广场查看 →
Google Gemini 多模态与长窗口系列
2M 超长上下文| 模型代号 (Model ID) | 上下文窗口 | 输入费率 (每 1M) | 输出费率 (每 1M) | 单次费率 | 平均首字延迟 | 核心专长与典型场景 |
|---|---|---|---|---|---|---|
| gemini-3.7-flash 多模态王者 | 1000K (1M) | $1.50 | $9.00 | $1.00/次 | ~240ms | 革命性多模态旗舰,原生支持长链思考、混合多模态(音视频+文本)极速秒级解析 |
| gemini-3.6-flash | 1000K (1M) | $1.50 | $9.00 | $1.00/次 | ~230ms | 海量长文档综合检索、全量高清视频理解与跨语言巨型资料库抽取 |
| gemini-3.5-flash | 1000K (1M) | $1.50 | $9.00 | $1.00/次 | ~220ms | 高并发业务即时问答、低成本高吞吐 Agent 群组协同基座 |
| gemini-3.1-pro 专业学术 | 2000K (2M) | $1.50 | $9.00 | $1.00/次 | ~280ms | 专业级跨学科学术科研、巨型单体工程源码库穿透分析 |
| gemini-2.0-flash | 1000K (1M) | $0.10 | $0.40 | - | ~180ms | 极致低延迟高性价比多模态,首字响应破记录,海量实时交互首选 |
🎁
在模型广场查看 →
福利特惠专区 (超低价 / 明星开源)
超值福利 · $0.15 起| 模型代号 (Model ID) | 上下文窗口 | 输入费率 (每 1M) | 输出费率 (每 1M) | 单次费率 | 平均首字延迟 | 核心专长与典型场景 |
|---|---|---|---|---|---|---|
| deepseek-v4.1-flash 明星爆款 | 128K | $0.22 | $0.66 | $0.50/次 | ~210ms | 新一代极致轻量与高推理深度,高吞吐企业级低成本调优首选,性价比无出其右 |
| glm-5.3-flash 清言旗舰 | 128K | $0.15 | $0.50 | $0.50/次 | ~200ms | 智谱清言最新旗舰极速版,中文深度语境原生对齐,公文写作与严密语义解析 |
| gpt-oss-20b | 64K | $2.50 | $15.00 | - | ~240ms | 高性能开源架构轻量调优,灵活微调适配与特定工业垂直领域私有化迁移 |
| gemma-4-31b-it Google 开源 | 32K | - | - | $0.50/次 | ~220ms | Google 最新开源重磅指令对齐模型,强大的逻辑严密性与轻量高效部署表现 |
| diffusiongemma-26b-a4b-it | 32K | - | - | $0.50/次 | ~250ms | 多模态扩散与语言架构创新融合模型,具备跨模态联想与图文深层共生理解 |
| ministral-14b-2512 | 32K | - | - | $0.50/次 | ~190ms | Mistral 高能端侧边缘与嵌入式轻量大模型,低时延边缘计算极佳选择 |
| mistral-code-latest 代码专精 | 64K | - | - | $0.50/次 | ~210ms | Mistral 官方编程专精最新版本,专为高精度代码补全、测试用例编写设计 |
| deepseek-chat (V3) | 64K | $0.14 | $0.28 | - | ~250ms | 国产全能基座性价比巅峰,中文深度理解、通用问答与企业级智能客服群首选 |
| deepseek-reasoner (R1) | 64K | $0.55 | $2.19 | - | ~450ms | 开源深度思维链推理天花板,长逻辑数学推理与复杂决策树构建 |
🎨
进入绘图工作台 →
专业视觉、生图与生视频模型矩阵
4K 超清 · 电影级运镜| 模型代号 (Model ID) | 服务工作台 | 单次调用价格 | 分辨率 / 时长 | 特色功能与技术亮点 | 接入方式 |
|---|---|---|---|---|---|
| gpt-image-2.5-sunburst 旗舰画质 | SuperFast 绘图工坊 | $1.50/次 (Token: $5.00/1M) | 超清 4K / 自定义比例 | 最新旗舰商业级艺术渲染,光影质感与复杂微结构渲染突破,海报级直出 | API Key / 绘图 Web 端 |
| gpt-image-2.5-flare | SuperFast 绘图工坊 | $1.50/次 (Token: $5.00/1M) | 超清 4K | 光影艺术增强、专业摄影单反虚化景深与真实人物肤质纹理还原 | API Key / 绘图 Web 端 |
| gpt-image-2 | SuperFast 绘图工坊 | $1.20/次 (In: $5, Out: $10/1M) | 1024x1024 / 高清 2K | 复杂字形排版、文字海报精准渲染与多物体空间拓扑关系准确定位 | API Key / 绘图 Web 端 |
| grok-imagine-image-quality | SuperFast 绘图工坊 | $2.00/次 | 高清宽屏 / 16:9 | xAI 独家艺术写实算法,动态光线反射与赛博朋克/超现实工业设计质感 | Grok Key / 绘图 Web 端 |
| SuperFast Video Engine 黑科技 | SuperFast 视频工坊 | 按秒弹性计费 · 不加价 | 4s ~ 12s 连贯高清 | 首尾帧同时锁死平滑过渡、角色原图 Reference 深度锚定、背景音乐情绪驱动 | 视频工坊 Web 端一键生成 |
💡 计费与兑换温馨提示
所有价格单位均为美元标准计费体系换算,无任何隐藏手续费或阶梯惩罚。平台支持通过 官方 24H 自动发卡商城 以超值汇率直接购买额度兑换码,充值即时入账。若您在万级高并发调用下需要定制独占通道,可联系技术客服 QQ: 2796802957 申请私有集群部署。