J8API 上全部 54 个文本对话模型的能力与定价, OpenAI 兼容协议, 一个 API Key 全部调用。
claude-fable-5) — $10/1M in · $50/1M out — Anthropic Claude Fable 5 — Mythos-class 旗舰claude-sonnet-5) — $1.8/1M in · $9/1M out — Anthropic 新一代 Sonnet, 编码 / Agent 性能接近旗舰 opus-4-8 而价格不到一半, 1M 上下文, 高性价比claude-opus-5) — $5/1M in · $25/1M out — Anthropic 旗舰 Claude Opus 5 (via GCP Vertex)claude-opus-4-8) — $4.5/1M in · $22.5/1M out — Anthropic 最新旗舰, SWE-Bench/OSWorld/Agent 优于 4.7gpt-5.6-luna) — $0.65/1M in · $3.9/1M out — GPT-5.6 家族轻量款,响应迅捷、成本更低,适合高并发与快速问答。gpt-5.6-terra) — $1.625/1M in · $9.75/1M out — GPT-5.6 家族均衡款,性能与成本兼顾,适合日常主力任务的可靠之选。gpt-5.6-sol) — $3.25/1M in · $19.5/1M out — GPT-5.6 家族旗舰款,性能最强,擅长复杂推理、长文本与高质量创作,追求极致质量的首选。gpt-5.5) — $3.25/1M in · $19.5/1M out — flagship 2026-04, Tier 5+ quotadeepseek-v4-pro) — $1.32/1M in · $2.64/1M out — 旗舰级 MoE 大模型 (1.6T 总参 / 49B 激活), 原生百万级上下文, 顶尖推理 + 代码 + 长文本deepseek-v4-flash) — $0.11/1M in · $0.22/1M out — 高效轻量化 MoE (284B 总参 / 13B 激活), 百万上下文, 高并发低延迟, 适合 RAG / 内容创作claude-opus-4-6) — $4.5/1M in · $22.5/1M out — Opus 4.6 (4.5-4.7 之间)claude-opus-4-5) — $5/1M in · $25/1M out — Opus 4.5 (首个 $5/$25 档)claude-sonnet-4-6) — $2.7/1M in · $13.5/1M out — Anthropic 主力, 性能/成本平衡claude-opus-4-7) — $4.5/1M in · $22.5/1M out — Anthropic 旗舰, 复杂推理/代码/分析claude-opus-4-1-20250805) — $15/1M in · $75/1M out — Opus 4.1 dated snapshotclaude-sonnet-4-5-20250929) — $2.7/1M in · $13.5/1M out — Sonnet 4.5 dated snapshotclaude-haiku-4-5-20251001) — $0.9/1M in · $4.5/1M out — Haiku 4.5 — 最快最便宜的新一代gemini-3.1-pro-preview) — $1.5/1M in · $9/1M out — Gemini 3.1 Pro preview, 200K+ 上下文 + thinkinggemini-3.1-flash-lite-preview) — $0.1875/1M in · $1.125/1M out — Gemini 3.1 Flash Lite 极低成本档gemini-3-flash-preview) — $0.375/1M in · $2.25/1M out — Gemini 3 Flash preview, 常规快速档gemini-3.5-flash) — $1.125/1M in · $6.75/1M out — Gemini 3.5 Flash — 最强 Flash 档gemini-2.5-flash) — $0.225/1M in · $1.875/1M out — 2.5 Flash — 快速性价比gemini-2.5-flash-lite) — $0.075/1M in · $0.3/1M out — 2.5 Flash Lite — 极低成本gpt-5.4) — $1.625/1M in · $9.75/1M out — 2026-03 GA, 1M contextdeepseek-v3.2) — $0.3135/1M in · $0.9405/1M out — 引入 DeepSeek Sparse Attention 的正式版, 首个将思考融入工具使用的模型, 同时支持思考模式与非思考模式。gpt-5.4-pro) — $19.5/1M in · $117/1M out — reasoning 旗舰gpt-5.4-mini) — $0.4875/1M in · $2.925/1M out — 价廉版主力gpt-5.4-nano) — $0.13/1M in · $0.8125/1M out — 极低价 (取代 gpt-3.5/4o-mini 角色)qwen3.7-max) — $1.75/1M in · $5.25/1M out — Qwen3.7 系列规模最大的旗舰模型, 面向智能体场景, 在编程 / 长周期任务 / 推理上有强势表现. 1M context.qwen-max) — $1.12/1M in · $4.48/1M out — 通义千问商业最强版, 综合能力旗舰. 适合复杂推理 / 多轮对话 / 高质量写作.qwen3.5-flash) — $0.07/1M in · $0.28/1M out — 通义千问 3.5 快速版, 低价高速, 含显式 cache.qwen3.5-27b) — $0.21/1M in · $1.68/1M out — 通义千问 3.5 开源 27B dense 模型, 中型规模性能均衡.qwen3.5-35b-a3b) — $0.175/1M in · $1.4/1M out — 通义千问 3.5 开源 35B-A3B 稀疏 (MoE) 模型, 激活参数 3B 推理快.qwen3.5-122b-a10b) — $0.28/1M in · $2.24/1M out — 通义千问 3.5 开源 122B-A10B 稀疏 (MoE) 模型, 激活参数 10B.qwen3.5-397b-a17b) — $0.42/1M in · $2.52/1M out — 通义千问 3.5 开源 397B-A17B 超大稀疏 (MoE), 激活 17B, 开源旗舰级.qwen3.6-27b) — $0.42/1M in · $2.52/1M out — 通义千问 3.6 开源 27B dense 模型, 中型规模.qwen3.6-35b-a3b) — $0.1736/1M in · $1.0395/1M out — 通义千问 3.6 开源 35B-A3B 稀疏 (MoE), 激活 3B 推理快.qwen3.5-plus) — $0.28/1M in · $1.68/1M out — 通义千问 3.5 商业增强版, 中端旗舰, 含显式 cache.qwen-flash) — $0.035/1M in · $0.28/1M out — 通义千问商业最快+最便宜, 适合简单问答 / 高并发场景.qwen3-max) — $0.84/1M in · $4.2/1M out — 通义千问 3 代旗舰, 长上下文能力增强, 含隐式+显式 cache.qwen3-max-preview) — $0.84/1M in · $4.2/1M out — 通义千问 3 代旗舰预览版, 公开测试通道, 适合开发者评估.qwen3.6-plus) — $0.35/1M in · $2.1/1M out — 通义千问 3.6 商业增强预览版, 比 plus 升级, 含显式 cache.qwen3.6-flash) — $0.175/1M in · $1.05/1M out — 通义千问 3.6 快速预览, 低价高速, 含显式 cache.qwen3.6-max-preview) — $0.91/1M in · $5.46/1M out — 通义千问 3.6 旗舰预览版, 性能升级, 含显式 cache.grok-4.3) — $1.25/1M in · $2.5/1M out — grok-4.20-0309-reasoning) — $1.25/1M in · $2.5/1M out — grok-4.20-0309-non-reasoning) — $1.25/1M in · $2.5/1M out — grok-4.20-multi-agent-0309) — $1.25/1M in · $2.5/1M out — grok-build-0.1) — $1/1M in · $2/1M out — qwen3.7-plus) — $0.28/1M in · $1.12/1M out — 通义千问 3.7 Plus 高性价比版: 文本能力强 + 视觉语言全面升级 + 全栈 agent 智能(编码/工具/GUI), 多模态(文本/图像/视频)输入→文本, 1M 上下文 + 推理glm-5.2) — $0.77/1M in · $2.42/1M out — GLM-5.2 是智谱 AI 面向长程任务的旗舰模型,支持 1M 上下文。kimi-k2.7-code) — $0.5225/1M in · $2.2/1M out — Moonshot Kimi K2.7 Code,代码生成模型,支持 256K 上下文。kimi-k3) — $2.55/1M in · $12.75/1M out — Kimi K3 是月之暗面面向长程编程与端到端知识工作的旗舰模型, 1M token 上下文, 始终开启思考模式 (reasoning_content 计入 token 消耗). 支持工具调用 / tqwen3.7-flash) — $0.021/1M in · $0.091/1M out — 通义千问 3.7 Flash 原生视觉语言模型: 多模态理解与 Agent 执行能力全面升级, 万物识别/空间智能增强, 多模态 Coding 优化, 1M 上下文 + 推理