Ctrl+K
没有找到匹配的模型,请尝试其他关键词

OpenAI (GPT / o 系列)

美国 全球最知名的大模型提供商,GPT-5.6 系列为最新旗舰,GPT-5.4 为推荐生产模型
模型名称 发布时间 输入价格 输出价格 缓存输入 上下文窗口 特点
GPT-5.6 Solgpt-5.6-sol 2026-07-09 $5.00 $30.00 $0.50 1M 最新旗舰,Agent/复杂推理
GPT-5.6 Terragpt-5.6-terra 2026-07-09 $2.00 $12.00 $0.20 1M 新一代中端,性能/成本平衡
GPT-5.6 Lunagpt-5.6-luna 2026-07-09 $0.20 $1.20 $0.02 1M 新一代轻量,极致低成本
GPT-5.5 Progpt-5.5-pro 2026-04-24 $30.00 $180.00 - 1M 高端推理,深度分析/科研
GPT-5.5gpt-5.5 2026-04-23 $5.00 $30.00 $0.50 1M 上代旗舰,Agent/复杂推理
GPT-5.4 Minigpt-5.4-mini 2026-03-17 $0.75 $4.50 $0.075 400K 高吞吐量生产任务
GPT-5.4 Nanogpt-5.4-nano 2026-03-17 $0.20 $1.25 $0.02 400K 极致低成本,分类/提取/路由
GPT-5.4gpt-5.4 2026-03-05 $2.50 $15.00 $0.25 1M 推荐生产模型,Computer Use
GPT-5.4 Progpt-5.4-pro 2026-03-05 $30.00 $180.00 - 1M 高端推理,取代 o 系列
GPT-5.3 Codexgpt-5.3-codex 2026-02-05 $1.75 $14.00 $0.175 400K 代码专用模型
GPT-5Legacygpt-5 2025-08-07 $1.25 $10.00 $0.125 128K 原旗舰推理模型
GPT-5 MiniLegacygpt-5-mini 2025-08-07 $0.25 $2.00 $0.025 128K GPT-5 轻量版
o3Legacyo3 2025-04-16 $2.00 $8.00 $0.50 200K 推理模型(已被 Pro 系列取代)
o4-miniLegacyo4-mini 2025-04-16 $1.10 $4.40 $0.275 200K 轻量推理模型
GPT-4.1Legacygpt-4.1 2025-04-14 $2.00 $8.00 $0.50 1M 原生产首选(已被 GPT-5.4 取代)
GPT-4.1 MiniLegacygpt-4.1-mini 2025-04-14 $0.40 $1.60 $0.10 1M 中端生产任务
GPT-4.1 NanoLegacygpt-4.1-nano 2025-04-14 $0.10 $0.40 $0.025 1M 极致低成本
GPT-4oLegacygpt-4o 2024-05-13 $2.50 $10.00 $1.25 128K 旧版多模态模型
提示:缓存折扣达 90%;长上下文(超过阈值)加价 50~100%;批量 API 全系 50% 折扣;Pro 模型无缓存。GPT-5.6 系列新增缓存写入计费(约为输入价 +25%);Fast mode(原 Priority,2026-07-30 更名)输入约 2 倍、输出约 1.5 倍。
OpenAI 官方定价页

OpenAI 多模态与工具计费

美国 图像生成、实时语音、语音转写及内置工具的计费;计价单位与文本模型不同,不宜与上一节直接横向对比
类别 模型名称 模态 输入价格 缓存输入 输出价格
图像生成 GPT Image 2gpt-image-2 图像 $8.00 $2.00 $30.00
图像生成 GPT Image 2gpt-image-2 文本 $5.00 $1.25 -
图像生成 GPT Image 1.5gpt-image-1.5 图像 $8.00 $2.00 $32.00
图像生成 GPT Image 1.5gpt-image-1.5 文本 $5.00 $1.25 $10.00
图像生成 GPT Image 1 Minigpt-image-1-mini 图像 $2.50 $0.25 $8.00
图像生成 GPT Image 1 Minigpt-image-1-mini 文本 $2.00 $0.20 -
实时语音 GPT Realtime 2.1gpt-realtime-2.1 音频 $32.00 $0.40 $64.00
实时语音 GPT Realtime 2.1gpt-realtime-2.1 文本 $4.00 $0.40 $24.00
实时语音 GPT Realtime 2.1gpt-realtime-2.1 图像 $5.00 $0.50 -
实时语音 GPT Realtime 2.1 Minigpt-realtime-2.1-mini 音频 $10.00 $0.30 $20.00
实时语音 GPT Realtime 2.1 Minigpt-realtime-2.1-mini 文本 $0.60 $0.06 $2.40
实时语音 GPT Realtime 2.1 Minigpt-realtime-2.1-mini 图像 $0.80 $0.08 -
实时语音 GPT Realtime Translategpt-realtime-translate 音频 - - $0.034 / 分钟
实时语音 GPT Realtime Whispergpt-realtime-whisper 音频 - - $0.017 / 分钟
语音转写 GPT Transcribegpt-transcribe 音频 - - $0.0045 / 分钟
语音转写 GPT Live Transcribegpt-live-transcribe 音频(实时) - - $0.017 / 分钟
语音转写 GPT-4o TranscribeLegacygpt-4o-transcribe 音频 $2.50 - $10.00
语音转写 GPT-4o Mini TranscribeLegacygpt-4o-mini-transcribe 音频 $1.25 - $5.00
提示:以上除标注「/ 分钟」者均为每百万 Tokens 价格;图像生成、转写支持批量 API 折扣。GPT-4o Transcribe 折合约 $0.006 / 分钟,Mini 约 $0.003 / 分钟。图像生成的实际花费与尺寸、质量相关,建议用官方估算器测算。

内置工具计费

  • Web search(全模型):$10.00 / 1k 次调用,检索内容 tokens 另按所选模型费率计
  • Web search preview(推理模型,gpt-5 / o 系列):$10.00 / 1k 次调用,检索内容 tokens 另计
  • Web search preview(非推理模型):$25.00 / 1k 次调用,检索内容 tokens 免费
  • File search:存储 $0.10 / GB·天(首 1 GB 免费);调用 $2.50 / 1k 次(仅 Responses API)
  • Containers(Hosted Shell / Code Interpreter):每 20 分钟会话每容器 1 GB $0.03、4 GB $0.12、16 GB $0.48、64 GB $1.92
  • Agent Kit:ChatKit 文件与图片上传存储 $0.10 / GB·天(每账户每月首 1 GB 免费)
工具消耗的 tokens 按所选模型的输入 / 输出费率计费;容器会话按分钟计费,每会话最低 5 分钟。Responses / Chat Completions / Realtime / Batch / Assistants 各 API 本身不单独收费。
OpenAI 官方定价页

Anthropic (Claude 系列)

美国 编程和长文本能力极强,Fable 5 为新一代旗舰($10/$50),Sonnet 5 限时 $2/$10
模型名称 发布时间 输入价格 输出价格 缓存命中 上下文窗口 特点
Claude Opus 5 2026-07-24 $5.00 $25.00 $0.50 - 复杂 Agent 编程与企业级任务
Claude Sonnet 5 2026-06-30 $2.00 $10.00 $0.20 - 高性能编程/Agent(限时价,见下方提示)
Claude Fable 5 2026-06-09 $10.00 $50.00 $1.00 - 新一代最强,长时程 Agent
Claude Opus 4.8Legacyclaude-opus-4-8-20260528 2026-05-28 $5.00 $25.00 $0.50 1M 上一代旗舰,Agent/编程/深度推理
Claude Opus 4.7Legacyclaude-opus-4-7-20260416 2026-04-16 $5.00 $25.00 $0.50 1M 旧版旗舰,编程/Agent
Claude Sonnet 4.6Legacyclaude-sonnet-4-6-20260115 2026-01-15 $3.00 $15.00 $0.30 1M 上一代性价比之选,生产可用
Claude Haiku 4.5claude-haiku-4-5-20241022 2025-10-15 $1.00 $5.00 $0.10 200K 快速轻量,分类/提取/路由
提示:Prompt Caching 写入为输入价 1.25×,命中仅 0.1× 输入价(90% 折扣);批量 API 50% 折扣;支持 Extended Thinking(思维 token 按输出计费)。Sonnet 5 的 $2/$10 为限时优惠价(2026-08-31 之后恢复 $3/$15)。Fable 5 / Opus 5 / Sonnet 5 的发布日期据 Anthropic 官方公告补全;上下文窗口与 API 模型 ID 官方定价页未列出,以 - 表示。
Anthropic 官方定价页

Google (Gemini 系列)

美国 超长上下文 + 免费层慷慨,Gemini 3.5 Flash 为最新旗舰($1.50/$9),3.1 Pro 支持 2M 上下文
模型名称 发布时间 输入价格 输出价格 上下文窗口 特点
Gemini 3.5 Flashgemini-3.5-flash 2026-05-19 $1.50 $9.00 1M 最新旗舰,搜索/Grounding/Agent
Gemini 3.1 Flash-Litegemini-3.1-flash-lite 2026-05-07 $0.25 $1.50 1M 最经济,高并发/翻译/数据处理
Gemini 3.1 Pro Previewgemini-3.1-pro-preview 2026-02-19 $2.00 $12.00 2M 最强多模态推理/Agent(>200K加价)
Gemini 3 FlashPreviewgemini-3-flash-preview 2025-12-17 $0.50 $3.00 1M 高性价比推理,Agent/编程
Gemini 2.5 Flash-LiteLegacygemini-2.5-flash-lite 2025-06-17 $0.10 $0.40 1M 超低价百万上下文
Gemini 2.5 FlashLegacygemini-2.5-flash 2025-05-20 $0.15 $0.60 1M 快速响应(思考token $3.50/M)
Gemini 2.5 ProLegacygemini-2.5-pro 2025-03-25 $1.25 $10.00 1M 原旗舰推理模型
Gemini 2.0 Flash已停用gemini-2.0-flash 2025-02-26 $0.10 $0.40 1M 超低价格,高并发场景
提示:免费层每日限额(3.x 系列共享);Pro 长上下文(>200K)加价 2x;批量 API 50% 折扣;上下文缓存 $1.00/M/小时存储。
Google Gemini 官方定价页

DeepSeek (深度求索)

中国 极致性价比,开源标杆,V4 系列 1M 上下文,缓存命中低至 $0.0028/M;官方已预告近期大幅涨价
模型名称 发布时间 输入(缓存未命中) 输入(缓存命中) 输出价格 上下文窗口 特点
DeepSeek-V4-Flashdeepseek-v4-flash 2026-07-31 $0.14 $0.0028 $0.28 1M 默认思考模式,支持 Responses API
DeepSeek-V4-ProPreviewdeepseek-v4-pro 2026-04-24 $0.435 $0.003625 $0.87 1M 更强推理,暂不支持 Responses API
提示:V4 系列上下文 1M、最大输出 384K,支持思考/非思考双模式,同时提供 OpenAI 与 Anthropic 两种接口格式;并发上限 Flash 2500、Pro 500。官方已公告近期将大幅上调价格,请按需规划用量。原 DeepSeek-V3(deepseek-chat)与 R1(deepseek-reasoner)已不在官方定价页列出。开源权重可私有化部署,无 API 费用。
DeepSeek 官方定价页

阿里云 (通义千问 Qwen)

中国 模型迭代极快,已更新至 Qwen3.8 系列,全系支持思考/非思考双模式
模型名称 发布时间 输入价格 输出价格 上下文窗口 特点
Qwen3.8-Maxqwen3.8-max 2026-08-03 ¥12.00 ¥36.00 1M 最新旗舰,思考/非思考双模式
Qwen3.7-Flashqwen3.7-flash 2026-07-15 ¥0.20(≤32K) ¥0.80 1M 极速低价,思考/非思考双模式
Qwen3.7-Plusqwen3.7-plus 2026-05-26 ¥2.00(≤256K) ¥8.00 1M 高性价比生产模型(限时 8 折)
Qwen3.7-Maxqwen3.7-max 2026-05-20 ¥12.00 ¥36.00 1M 上一代旗舰,Agent 优化(限时 5 折)
Qwen3.6-MaxPreviewqwen3.6-max-preview 2026-04-20 ¥9.00(≤128K) ¥54.00 128K 预览版高性能模型
Qwen3.6-Flashqwen3.6-flash 2026-04-16 ¥1.20(≤256K) ¥7.20 1M 快速推理,思考模式,性价比高
Qwen3.6-Plusqwen3.6-plus 2026-04-02 ¥2.00(≤256K) ¥12.00 1M 均衡性能,思考模式,Agent 增强
Qwen3.5-Flashqwen3.5-flash 2026-02-23 ¥0.20(≤128K) ¥2.00 1M 极速低价,日常轻量任务
Qwen3.5-Plusqwen3.5-plus 2026-02-15 ¥0.80(≤128K) ¥4.80 1M 多模态,纯文本媲美 Max
Qwen3-MaxLegacyqwen3-max 2026-01-23 ¥2.50(≤32K) ¥10.00 256K 上一代旗舰,思考/非思考双模式
Qwen-PlusLegacyqwen-plus 2025-12-01 ¥0.80(≤128K) ¥2.00 / ¥8.00 1M 经典高性价比,非思考 / 思考分开计价
Qwen-FlashLegacyqwen-flash 2025-07-28 ¥0.15(≤128K) ¥1.50 1M 上一代最低价,高并发简单任务
提示:新用户享各模型 100 万 Token 免费额度(90 天有效);Batch 调用半价;支持上下文缓存折扣。全系按单次请求的输入 Token 数阶梯计价,表中为最低档单价(括号内为该档区间),超出后逐档上浮(如 Qwen3.7-Plus 在 256K~1M 区间为 ¥6.00 / ¥24.00)。Qwen3.7-Max 限时 5 折、Qwen3.7-Plus 限时 8 折,表中为折前原价。以上为国内(华北2·北京)价格,国际站另行计价。Qwen-Plus 输出价按模式区分(非思考 ¥2.00 / 思考 ¥8.00),其余模型两种模式同价。官方定价页未列出上下文窗口,表中 1M / 128K 按最高计价档的输入上限推算,Qwen3-Max 的 256K 沿用原有数据(定价页仅列到 ≤32K 档);Qwen3.8-Max / Qwen3.6-Max 的发布日期据官方发布公告补全(定价页未列出)。
阿里云百炼 官方定价页

百度 (文心一言 ERNIE)

中国 原生多模态,ERNIE 4.5 开源,Speed/Lite 系列完全免费
模型名称 发布时间 输入价格 输出价格 上下文窗口 特点
ERNIE 4.5 Turboernie-4.5-turbo-128k 2025-05-19 ¥2.00 ¥8.00 128K 更快更便宜,去幻觉增强
ERNIE 4.5ernie-4.5-8k-preview 2025-03-16 ¥4.00 ¥16.00 128K 旗舰版,原生多模态,已开源
ERNIE Speed / Liteernie-speed-128k / ernie-lite-128k 2024-04-02 免费 免费 128K 完全免费,适合基础场景
ERNIE 4.0ernie-4.0-8k-latest 2023-10-17 ¥3.00 ¥6.00 128K 综合能力强,企业主力
提示:ERNIE 4.5 系列已开源(MoE 424B),可本地部署;Speed/Lite 永久免费。
百度千帆 官方模型中心

月之暗面 (Kimi)

中国 万亿参数 MoE 架构,K3 为最新旗舰(1M 上下文),K2.7 Code 专注编程场景
模型名称 发布时间 输入(缓存未命中) 输入(缓存命中) 输出价格 上下文窗口 特点
Kimi K3kimi-k3 2026-07-16 ¥20.00 ¥2.00 ¥100.00 1M 旗舰模型,始终推理,长程编程与知识工作
Kimi K2.7 Code HighSpeedkimi-k2.7-code-highspeed 2026-06-15 ¥13.00 ¥2.60 ¥54.00 256K 与 K2.7 Code 同模型,输出约 180 Tokens/s
Kimi K2.7 Codekimi-k2.7-code 2026-06-13 ¥6.50 ¥1.30 ¥27.00 256K 编程专用,文本/图片/视频输入,仅思考模式
Kimi K2.6kimi-k2.6 2026-04-20 ¥6.50 ¥1.10 ¥27.00 256K 支持视觉与文本输入,长程代码极强
Kimi K2Legacykimi-k2-0711 2025-07-11 ¥4.00 - ¥16.00 128K 万亿参数 MoE,编程 SOTA
提示:全系支持自动上下文缓存、Tool Calls、JSON Mode、结构化输出;K3 始终推理,可通过 reasoning_effort 调节推理强度(low / high / max,默认 max)。Moonshot V1 系列预计 2026-08-31 全平台下线;Kimi K2(kimi-k2-0711)已不在官方定价页列出。K3 / K2.7 Code / K2.7 Code HighSpeed 的发布日期据月之暗面官方公告补全(官方定价页未列出)。
Kimi 官方定价页

智谱 AI (GLM 系列)

中国 清华系 AI,GLM-5.1 新旗舰上线,开源生态活跃
模型名称 发布时间 价格(输入输出同价) 上下文窗口 特点
GLM-5.1glm-5-1 2026-04-07 ¥5.00 / M Tokens 128K 最新旗舰,Agent/编码/推理全面提升
GLM-4-Plusglm-4-plus 2024-09-01 ¥5.00 / M Tokens 128K 上代旗舰,对标 GPT-4
GLM-4-Longglm-4-long 2024-08-12 ¥1.00 / M Tokens 1M 百万级上下文长文处理
GLM-4-Flashglm-4-flash 2024-08-01 免费 128K 免费开放,适合快速原型
GLM-4-Airglm-4-air 2024-06-06 ¥1.00 / M Tokens 128K 高性价比,推理速度快
提示:新用户注册赠送 2000 万 Tokens;GLM-4-Flash 永久免费;支持 Batch API 半价。
智谱 AI 官方定价页

腾讯 (混元大模型)

中国 腾讯云旗下,MoE 架构,Lite 免费且支持 256K 超长上下文
模型名称 发布时间 输入价格 输出价格 上下文窗口 特点
混元 Prohunyuan-pro 2024-09-05 ¥2.00 ¥5.00 32K 旗舰模型,推理能力强
混元 Standardhunyuan-standard 2024-06-21 ¥0.80 ¥2.00 32K 标准版,通用对话
混元 Litehunyuan-lite 2024-06-21 免费 免费 256K 完全免费,超长上下文
提示:混元 Lite 完全免费且支持 256K 上下文,适合个人开发者和中小企业。
腾讯混元 官方页面

对比总结

按使用场景推荐

  • 极致性能(不差钱):GPT-5.5 Pro ($30/$180) / Claude Fable 5 ($10/$50) / GPT-5.6 Sol ($5/$30) / Claude Opus 5 ($5/$25)
  • 性能与成本平衡:Claude Sonnet 5 / GPT-5.4 / Gemini 3.5 Flash — 日常生产力首选
  • 极致性价比:DeepSeek-V4-Flash ($0.14/$0.28) / GPT-5.6 Luna ($0.20/$1.20) / Gemini 3.1 Flash-Lite ($0.25/$1.50) / Qwen3.7-Flash (¥0.20/¥0.80)
  • 超长上下文(1M+):Gemini 3.1 Pro Preview(2M)/ GPT-5.5、GPT-5.4(1M)/ DeepSeek-V4 系列(1M)/ Qwen3.8-Max、Qwen3.7-Max(1M)/ Kimi K3(1M)
  • 完全免费:ERNIE Speed/Lite / 混元 Lite / GLM-4-Flash / Gemini 免费层
  • 私有化部署:DeepSeek / Qwen 开源 / GLM 开源 / ERNIE 4.5 开源

海外模型价格速览(输入 / 输出,每百万 Tokens)

  • $0.14 / $0.28:DeepSeek-V4-Flash(全球最低)
  • $0.20 / $1.20:GPT-5.6 Luna
  • $0.20 / $1.25:GPT-5.4 Nano
  • $0.25 / $1.50:Gemini 3.1 Flash-Lite
  • $0.435 / $0.87:DeepSeek-V4-Pro
  • $0.50 / $3.00:Gemini 3 Flash
  • $0.75 / $4.50:GPT-5.4 Mini
  • $1.00 / $5.00:Claude Haiku 4.5
  • $1.50 / $9.00:Gemini 3.5 Flash
  • $1.75 / $14.00:GPT-5.3 Codex(代码专用)
  • $2.00 / $10.00:Claude Sonnet 5(限时价,8/31 后 $3/$15)
  • $2.00 / $12.00:GPT-5.6 Terra、Gemini 3.1 Pro Preview
  • $2.50 / $15.00:GPT-5.4
  • $5.00 / $25.00:Claude Opus 5
  • $5.00 / $30.00:GPT-5.5、GPT-5.6 Sol
  • $10.00 / $50.00:Claude Fable 5
  • $30.00 / $180.00:GPT-5.5 Pro、GPT-5.4 Pro
  • 说明:仅列当前在售模型,Legacy 与已停用模型的价格见各厂商章节

国内模型价格速览(输入 / 输出,每百万 Tokens,人民币)

  • 免费:ERNIE Speed/Lite、混元 Lite、GLM-4-Flash
  • ¥0.20 / ¥0.80:Qwen3.7-Flash(≤32K 档)
  • ¥0.20 / ¥2.00:Qwen3.5-Flash(≤128K 档)
  • ¥0.80 / ¥2.00:混元 Standard
  • ¥0.80 / ¥4.80:Qwen3.5-Plus(≤128K 档)
  • ¥1.00:GLM-4-Air、GLM-4-Long(输入输出同价)
  • ¥1.20 / ¥7.20:Qwen3.6-Flash(≤256K 档)
  • ¥2.00 / ¥5.00:混元 Pro
  • ¥2.00 / ¥8.00:Qwen3.7-Plus(≤256K 档)、ERNIE 4.5 Turbo
  • ¥2.00 / ¥12.00:Qwen3.6-Plus(≤256K 档)
  • ¥3.00 / ¥6.00:ERNIE 4.0
  • ¥4.00 / ¥16.00:ERNIE 4.5
  • ¥5.00:GLM-5.1、GLM-4-Plus(输入输出同价)
  • ¥6.50 / ¥27.00:Kimi K2.6、Kimi K2.7 Code(缓存未命中输入价)
  • ¥9.00 / ¥54.00:Qwen3.6-Max(Preview,≤128K 档)
  • ¥12.00 / ¥36.00:Qwen3.8-Max、Qwen3.7-Max(限时 5 折)
  • ¥13.00 / ¥54.00:Kimi K2.7 Code HighSpeed(缓存未命中输入价)
  • ¥20.00 / ¥100.00:Kimi K3(缓存未命中输入价,命中 ¥2.00)
  • 说明:仅列当前在售模型,Legacy 模型的价格见各厂商章节
✅ 已复制到剪贴板