企业级专业稳定的AI大模型API中转站
本站均为官方源头转发,价格八折(叠加充值加赠和汇率优势),聚合各种优秀大模型。不限速,不惧封号,按量计费,长期可靠服务。
本站均为官方源头转发,价格八折(叠加充值加赠和汇率优势),聚合各种优秀大模型。不限速,不惧封号,按量计费,长期可靠服务。
🔥 当前推荐模型
以下为当前稳定供给的热门模型,完整模型列表和实时价格请访问 API易控制台定价页面,也可查看站内 模型价格总览。表格中上下文一栏标注为「—」的,表示厂商暂未公布明确数值,实际以控制台与官方文档为准。价格均为每 100 万 tokens 挂牌价,可叠加充值加赠优惠。
模型分类
🤖 OpenAI 系列
🆕 最新模型
GPT-5.6 双分组供给:默认官转分组(default / svip)与官网同价,充值最多赠 20%(约 83 折);
CodexReverse 分组默认 0.7 折扣,适合成本敏感的批量任务。存量 GPT-5.5 代码只需替换 model 字段即可迁移。详见 GPT-5.6 系列上线说明。✅ 稳定/经典系列
图像和视频生成模型已移至专属页面,请访问 图像与视频生成模型 查看完整列表和定价。
🎭 Claude 系列 (Anthropic)
🆕 最新模型
✅ 稳定/经典系列
最新推荐:Claude Opus 5 智能逼近 Fable 5,但价格只有一半($5/$25,与 Opus 4.8 持平),属于”无痛升级”。Sonnet 5 官方称”迄今最具 Agentic 能力的 Sonnet”,性能逼近 Opus 4.8 而更快更省。稳定首选:Opus 4.7 / Sonnet 4.6 经过充分验证,适合已上线的生产工作流;Haiku 4.5 速度快 2 倍、性价比高。
🌟 Google Gemini 系列
🆕 最新模型
✅ 稳定/经典系列
最新推荐:Gemini 3.6 Flash 与 3.5 Flash-Lite 已完成 Gemini 原生格式 + OpenAI 兼容格式各 30+ 用例的双端点实测,原生工具全部放通,接入前建议先看 3.6 Flash 概览 与 3.5 Flash-Lite 概览。稳定首选:Gemini 2.5 Pro(2M 超长上下文)和 Gemini 2.5 Flash 适合已定型的生产环境。
🚀 xAI Grok 系列
🆕 最新模型
✅ 稳定/经典系列
Grok 4.5 的 token 效率优势:SWE Bench Pro 上平均输出仅 15,954 tokens,约为 Opus 4.8 (max) 的 1/4.2,任务步数减半,同任务实际花费显著更低。注意超过 200K tokens 的高上下文请求按官方更高费率计费。
🔍 DeepSeek 系列
🐘 国产模型系列
智谱 AI (GLM)
🆕 最新:GLM-5.2 | ✅ 稳定/经典:GLM-5.1、GLM-5、GLM-4.6GLM-5.2 特性:
- 上下文由 GLM-5.1 的 200K 跃升至 1M tokens,可一次载入项目级代码与多份长文档
- 744B MoE,Terminal-Bench 2.1 81.0 / SWE-bench Pro 62.1,长程编程基准开源领先
- 经阿里云官方授权直连,价格对齐官网(按 1:7 固定汇率折算),叠加充值活动约官网 85 折
- 长任务建议把 timeout 调到 600 秒以上,详见 GLM-5.2 上线说明
阿里通义千问 (Qwen)
🆕 最新:Qwen3.7-Max | ✅ 稳定/经典:Qwen3.6 系列、Qwen Max / Plus / TurboMoonshot Kimi 系列
🆕 最新:Kimi K3 | ✅ 稳定/经典:Kimi K2.6、K2.5、K2Kimi K3 使用要点:
- 精确 1,048,576 tokens 上下文,全区间统一计价,长代码库 / 长文档可整体塞入,不担心跨档涨价
- 最大输出默认 131,072、最高可调至 1,048,576 tokens;思考模式常开满档,请预留输出预算
- 自动上下文缓存,命中部分输入按 $0.30/1M 计费(未命中价的 1/10),多轮对话收益显著
字节跳动 Seed 系列
🆕 最新:Seed 2.1 Turbo | ✅ 稳定/经典:Seed 2.0 Pro / Lite / Mini🌐 MiniMax 系列
🆕 最新:MiniMax-M3 | ✅ 稳定/经典:MiniMax-M2.7、M2.5MiniMax-M3 计费说明:
- 采用阶梯计费,0-512K 区间 $0.30 输入 / $1.20 输出(每 1M tokens),超出部分按更高档单价计费
- 注意模型名大小写:
MiniMax-M3(同系列MiniMax-M2.7-highspeed等亦区分大小写) - 做百万级长上下文任务前请预估好成本
💰 定价说明
计费方式
- 按量计费:根据实际使用的 Token 数量计费
- 无最低消费:充多少用多少
- 余额有效期:自充值之日起 365 天内有效,再次充值自动重置(详见充值活动说明)
- 实时扣费:每次调用后立即从余额扣除费用
价格优势
- 官方源头转发,价格略有优势
- 批量使用可联系客服获取更优惠价格
- 新用户注册后账号自带 $0.05 试用额度,可直接跑通接入验证
查看实时价格
访问 API易控制台定价页面 查看所有模型的最新价格,或查看站内 模型价格总览。🛠️ 使用建议
模型选择指南
编程开发- 顶级性能:Claude Opus 5(智能逼近 Fable 5、价格一半)、GPT-5.6 Sol(Terminal-Bench 2.1 88.8%)、Claude Sonnet 5(SWE-bench 85.2%)、Kimi K3
- 高性价比:GPT-5.6 Terra(GPT-5.5 级性能价格减半)、Gemini 3.6 Flash、GLM-5.2、MiniMax-M3、DeepSeek V4 Flash
- 备选:Grok 4.5、Qwen3.7-Max、Kimi K2.6、Gemini 3.5 Flash
- 首选:GPT-5.6 Sol / Terra、Claude Opus 5、Claude Sonnet 5、Gemini 3.6 Flash
- 备选:chat-latest、Claude Sonnet 4.6、GLM-5.2、GPT-4.1
- 首选:Gemini 3.5 Flash-Lite(默认零思考、约 2 秒)、Claude Haiku 4.5(速度快 2 倍)、GPT-5.6 Luna
- 备选:Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Seed 2.1 Turbo(需显式关闭思考)
- 超长上下文:Gemini 2.5 Pro(2M)、Kimi K3(1M 全区间统一计价)、MiniMax-M3(1M)、GLM-5.2(1M)、Claude Opus 5(1M)
- 注意:部分模型超过一定长度会按更高档阶梯计费(如 Grok 4.5 超 200K、MiniMax-M3 超 512K),长任务前请预估成本
- 最新推荐:gpt-image-2(原生 4K、size/quality 精确控制)、Nano Banana Pro(4K 高清,最佳文本渲染)
- 高性价比:Nano Banana 2($0.055/张,按量低至 $0.025)、Nano Banana Lite(约 4 秒出图,$0.025/张)
- 专业设计:Seedream 5.0 Pro($0.12/次,交互式编辑 + 最多 10 张参考图)、Seedream 5.0 Lite($0.035/张)
- 最便宜:gpt-image-2-all(官逆,$0.03/张)
- 官转首选:VEO 3.1 Official(按次 $0.3 / $1.2,4/6/8 秒,原生同步音轨)
- 国产主力:Seedance 2.0 系列(标准 / fast / mini 三档)、Wan2.7、HappyHorse 1.1
- 注意:Sora 2 相关通道已下线,请改用上述通道,详见 图像与视频生成模型
- 原生联网:Grok 4 All、Grok 3 All(无需工具调用)
- 搜索 grounding:Gemini 3.6 Flash / 3.5 Flash-Lite(原生工具已放通)
成本优化建议
- 分级使用:简单任务用便宜模型,复杂任务用高级模型
- 测试优化:先用小模型测试,确定需求后再用大模型
- 批量处理:大量相似任务可以选择 Luna / Lite / Mini 档位
- 缓存复用:善用各家的上下文缓存(Kimi K3、Seed 2.1 Turbo、Claude 系列命中后输入价可低至 1/10)
- 关闭不必要的思考:部分模型默认开启深度思考(如 Seed 2.1 Turbo、Gemini 3.6 Flash),高频短问答显式关闭可同时省钱提速
🔗 相关资源
模型列表持续更新中,我们会及时添加最新发布的优秀模型。最新上新动态请关注 网站公告。如需使用特定模型或有批量需求,请联系客服。