Model Catalog

Browse governed public AI model information and pricing.

33 models available

Language

Claude-Fable-5

Advanced Claude model for long-running agents, deep reasoning, and complex multi-step work.

Price
Input $9.89 / Output $49.89 per 1M tokens

Claude-Haiku-4.5

Fast, efficient Claude model for responsive coding, reasoning, and everyday AI tasks.

Price
Input $0.96 / Output $4.89 per 1M tokens

Claude-Opus-4.5

High-capability Claude model for complex coding, agentic workflows, computer use, and professional knowledge work.

Price
Input $4.89 / Output $24.89 per 1M tokens

Claude-Opus-4.6

Advanced Claude model for long-horizon coding, large-codebase reasoning, debugging, research, and professional work.

Price
Input $4.69 / Output $24.89 per 1M tokens

Claude-Opus-4.7

Advanced Claude model for coding, vision, complex multi-step tasks, and professional knowledge work, with strong reliability in agentic workflows.

Price
Input $4.89 / Output $24.69 per 1M tokens

Claude-Opus-4.8

Powerful Claude model for advanced coding, agentic workflows, reasoning, and practical knowledge work.

Price
Input $4.89 / Output $24.89 per 1M tokens

Claude-Sonnet-4.5

Balanced Claude model for coding, complex agents, computer use, reasoning, and mathematics.

Price
Input $2.89 / Output $14.89 per 1M tokens

Claude-Sonnet-4.6

Balanced Claude model for coding, agent planning, long-context reasoning, computer use, and professional work.

Price
Input $2.89 / Output $14.89 per 1M tokens

Claude-Sonnet-5

Highly agentic Claude model for coding, tool use, reasoning, and professional work, delivering strong autonomy at Sonnet-class speed and cost.

Price
Input $1.89 / Output $9.89 per 1M tokens

DeepSeek-V3.2

Efficient DeepSeek model for everyday reasoning, coding, writing, and general-purpose AI assistance.

Price
Input $0.2 / Output $0.3 per 1M tokens

DeepSeek-V3.2-Thinking

Reasoning-focused DeepSeek model for complex analysis, step-by-step problem solving, and thoughtful responses.

Price
Input $0.42 / Output $0.85 per 1M tokens

DeepSeek-V4-Flash

High-efficiency DeepSeek V4 model for coding, reasoning, and agent workflows, with 1M context, thinking and non-thinking modes, tool calls, and JSON output.

Price
Input $0.133 / Output $0.266 per 1M tokens

DeepSeek-V4-Flash-0731

DeepSeek-V4-Flash-0731 is the official DeepSeek V4 Flash release, retaining the 284B-parameter architecture with 13B active parameters of the preview version while significantly strengthening agent capabilities through updated post-training. It supports a 1M-token context window, up to 384K output, thinking and non-thinking modes (thinking by default), JSON output, tool calls, native Responses API support, and Codex-oriented coding-agent workflows.

Price
Input $0.14 / Output $0.29 per 1M tokens

DeepSeek-V4-Pro

DeepSeek model for complex reasoning, coding, analysis, and professional text tasks.

Price
Input $0.43 / Output $0.86 per 1M tokens

GLM-5-Turbo

Fast GLM model for everyday AI tasks, coding assistance, tool use, and responsive conversations.

Price
Input $1.15 / Output $3.85 per 1M tokens

GLM-5.1

Flagship GLM model for long-horizon agentic coding and complex engineering work, with sustained planning, execution, tool use, and iterative optimization.

Price
Input $1.33 / Output $4.18 per 1M tokens

GLM-5.2

Flagship GLM model for long-horizon coding, complex engineering, and autonomous agent workflows, with a 1M-token context window and flexible reasoning effort.

Price
Input $1.33 / Output $4.18 per 1M tokens
Context
1,000,000 tokens

GPT-5.4

Capable GPT model for coding, reasoning, tool use, and complex professional work.

Price
Input $2.38 / Output $14.25 per 1M tokens

GPT-5.5

Frontier GPT model for complex coding, persistent agentic work, reliable tool use, and professional tasks.

Price
Input $4.89 / Output $29.89 per 1M tokens

GPT-5.6-Luna

Efficient GPT-5.6 model for cost-sensitive, high-volume reasoning, coding, and agentic workloads.

Price
Input $0.19 / Output $1.14 per 1M tokens

GPT-5.6-Sol

Frontier GPT-5.6 model for complex reasoning, coding, science, cybersecurity, and long-horizon agentic work.

Price
Input $4.96 / Output $29.89 per 1M tokens

GPT-5.6-Terra

Balanced GPT-5.6 model for capable reasoning, coding, tool use, and everyday professional work.

Price
Input $1.89 / Output $11.89 per 1M tokens

Kimi-K2.5

Native multimodal Kimi model for reasoning, coding, visual understanding, and agentic workflows, with coordinated parallel-agent capabilities.

Price
Input $0.36 / Output $1.95 per 1M tokens

Kimi-K2.6

Native multimodal Kimi model for advanced coding, reasoning, and long-horizon agent workflows, with strong tool use and parallel-agent execution.

Price
Input $0.9 / Output $3.8 per 1M tokens

Kimi-K3

Kimi K3 is the world's first open-weight 3T-level model, boasting 2.8T parameters. It's designed for cutting-edge intelligent tasks such as long-horizon coding, knowledge work, and reasoning, natively supporting visual capabilities and featuring a context window with 1 million tokens.

Price
Input $2.75 / Output $13.3 per 1M tokens

MiniMax-M2.5

MiniMax model for chat, coding, office work, and agentic tasks

Price
Input $0.145 / Output $0.88 per 1M tokens

MiniMax-M2.7

MiniMax model for chat, coding, office work, and agentic tasks

Price
Input $0.285 / Output $1.14 per 1M tokens

MiniMax-M3

Frontier MiniMax model for coding and agentic workflows, combining a 1M-token context window, native multimodality, tool use, and long-horizon execution.

Price
Input $0.29 / Output $1.15 per 1M tokens

Qwen3.6-27B

Qwen vision-language model for visual reasoning, documents, and agent tasks

Price
Input $0.25 / Output $1.85 per 1M tokens

Qwen3.6-Plus

Native vision-language Qwen model for agentic coding, reasoning, visual understanding, document work, and tool-enabled workflows.

Price
Input $0.31 / Output $1.85 per 1M tokens

Qwen3.7-Max

Flagship Qwen model for programming, reasoning, professional productivity, and long-horizon autonomous agent workflows.

Price
Input $1.19 / Output $3.7 per 1M tokens

Qwen3.7-Plus

Multimodal Qwen model for coding, reasoning, visual understanding, tool use, and interactive agent workflows across documents, screens, and applications.

Price
Input $0.32 / Output $1.26 per 1M tokens

Qwen3.8-Max

The MoE flagship, boasting 2.4 trillion parameters, delivers a comprehensive leap in programming and office capabilities, enabling autonomous programming for over ten days to deliver complete projects. It excels in hundreds of professional tasks across fields such as law, finance, and design, delivering production-grade results through a single, end-to-end dialogue. Native visual understanding permeates the entire planning, execution, and verification process, supporting deep semantic analysis of ultra-long documents and videos. In long-term tasks, it enables autonomous planning and closed-loop iteration, continuously evolving.

Price
Input $1.9 / Output $5.7 per 1M tokens

模型目录

浏览受治理的公开 AI 模型信息和价格。

33 个可用模型

语言

Claude-Fable-5

先进 Claude 模型,适用于长时间运行的 Agent、深度推理和复杂的多步骤工作。

价格
输入 $9.89 / 输出 $49.89 每 100 万 tokens

Claude-Haiku-4.5

快速高效的 Claude 模型,适用于响应迅速的编码、推理和日常 AI 任务。

价格
输入 $0.96 / 输出 $4.89 每 100 万 tokens

Claude-Opus-4.5

高能力 Claude 模型,适用于复杂编码、Agent 工作流、计算机使用和专业知识工作。

价格
输入 $4.89 / 输出 $24.89 每 100 万 tokens

Claude-Opus-4.6

先进 Claude 模型,适用于长周期编码、大型代码库推理、调试、研究和专业工作。

价格
输入 $4.69 / 输出 $24.89 每 100 万 tokens

Claude-Opus-4.7

高级 Claude 模型,适用于编码、视觉、复杂多步骤任务和专业知识工作,在智能体工作流中具有较强可靠性。

价格
输入 $4.89 / 输出 $24.69 每 100 万 tokens

Claude-Opus-4.8

强大的 Claude 模型,适用于高级编码、Agent 工作流、推理和实用知识工作。

价格
输入 $4.89 / 输出 $24.89 每 100 万 tokens

Claude-Sonnet-4.5

均衡的 Claude 模型,适用于编码、复杂 Agent、计算机使用、推理和数学。

价格
输入 $2.89 / 输出 $14.89 每 100 万 tokens

Claude-Sonnet-4.6

均衡的 Claude 模型,适用于编码、Agent 规划、长上下文推理、计算机使用和专业工作。

价格
输入 $2.89 / 输出 $14.89 每 100 万 tokens

Claude-Sonnet-5

高度智能体化的 Claude 模型,适用于编码、工具使用、推理和专业工作,在 Sonnet 级速度与成本下提供较强自主性。

价格
输入 $1.89 / 输出 $9.89 每 100 万 tokens

DeepSeek-V3.2

高效 DeepSeek 模型,适用于日常推理、编码、写作和通用 AI 辅助。

价格
输入 $0.2 / 输出 $0.3 每 100 万 tokens

DeepSeek-V3.2-Thinking

专注推理的 DeepSeek 模型,适用于复杂分析、分步问题求解和深思熟虑的回答。

价格
输入 $0.42 / 输出 $0.85 每 100 万 tokens

DeepSeek-V4-Flash

高效 DeepSeek V4 模型,适用于编码、推理和智能体工作流,支持 100 万上下文、思考和非思考模式、工具调用及 JSON 输出。

价格
输入 $0.133 / 输出 $0.266 每 100 万 tokens

DeepSeek-V4-Flash-0731

DeepSeek-V4-Flash-0731 是 DeepSeek V4 Flash 的正式发布版本,保留预览版的 284B 参数架构和 13B 活跃参数,并通过更新后的后训练显著增强智能体能力。它支持 100 万 token 上下文窗口、最高 384K 输出、思考与非思考模式(默认思考)、JSON 输出、工具调用、原生 Responses API 支持以及面向 Codex 的编码智能体工作流。

价格
输入 $0.14 / 输出 $0.29 每 100 万 tokens

DeepSeek-V4-Pro

DeepSeek 模型,适用于复杂推理、编码、分析和专业文本任务。

价格
输入 $0.43 / 输出 $0.86 每 100 万 tokens

GLM-5-Turbo

快速 GLM 模型,适用于日常 AI 任务、编码辅助、工具使用和快速响应式对话。

价格
输入 $1.15 / 输出 $3.85 每 100 万 tokens

GLM-5.1

旗舰 GLM 模型,适用于长周期智能体编码和复杂工程工作,支持持续规划、执行、工具使用和迭代优化。

价格
输入 $1.33 / 输出 $4.18 每 100 万 tokens

GLM-5.2

旗舰 GLM 模型,适用于长周期编码、复杂工程和自主智能体工作流,拥有 100 万 token 上下文窗口及可调推理强度。

价格
输入 $1.33 / 输出 $4.18 每 100 万 tokens
上下文
1,000,000 tokens

GPT-5.4

能力出色的 GPT 模型,适用于编码、推理、工具使用和复杂专业工作。

价格
输入 $2.38 / 输出 $14.25 每 100 万 tokens

GPT-5.5

前沿 GPT 模型,适用于复杂编码、持续的 Agent 工作、可靠的工具使用和专业任务。

价格
输入 $4.89 / 输出 $29.89 每 100 万 tokens

GPT-5.6-Luna

高效 GPT-5.6 模型,适用于注重成本的大规模推理、编码和 Agent 工作负载。

价格
输入 $0.19 / 输出 $1.14 每 100 万 tokens

GPT-5.6-Sol

前沿 GPT-5.6 模型,适用于复杂推理、编码、科学、网络安全和长周期 Agent 工作。

价格
输入 $4.96 / 输出 $29.89 每 100 万 tokens

GPT-5.6-Terra

均衡的 GPT-5.6 模型,适用于高能力推理、编码、工具使用和日常专业工作。

价格
输入 $1.89 / 输出 $11.89 每 100 万 tokens

Kimi-K2.5

原生多模态 Kimi 模型,适用于推理、编码、视觉理解和智能体工作流,具备协同并行智能体能力。

价格
输入 $0.36 / 输出 $1.95 每 100 万 tokens

Kimi-K2.6

原生多模态 Kimi 模型,适用于高级编码、推理和长周期智能体工作流,具有强大的工具使用和并行智能体执行能力。

价格
输入 $0.9 / 输出 $3.8 每 100 万 tokens

Kimi-K3

Kimi K3 是全球首个开放权重的 3T 级模型,拥有 2.8T 参数。它面向长周期编程、知识工作和推理等前沿智能任务而设计,原生支持视觉能力,并配备 100 万 tokens 的上下文窗口。

价格
输入 $2.75 / 输出 $13.3 每 100 万 tokens

MiniMax-M2.5

MiniMax 模型,适用于聊天、编码、办公工作和 Agent 任务。

价格
输入 $0.145 / 输出 $0.88 每 100 万 tokens

MiniMax-M2.7

MiniMax 模型,适用于聊天、编码、办公工作和 Agent 任务。

价格
输入 $0.285 / 输出 $1.14 每 100 万 tokens

MiniMax-M3

前沿 MiniMax 模型,面向编码和智能体工作流,结合 100 万 token 上下文窗口、原生多模态、工具使用与长周期执行。

价格
输入 $0.29 / 输出 $1.15 每 100 万 tokens

Qwen3.6-27B

Qwen 视觉语言模型,适用于视觉推理、文档和 Agent 任务。

价格
输入 $0.25 / 输出 $1.85 每 100 万 tokens

Qwen3.6-Plus

原生视觉语言 Qwen 模型,适用于智能体编码、推理、视觉理解、文档工作和工具增强工作流。

价格
输入 $0.31 / 输出 $1.85 每 100 万 tokens

Qwen3.7-Max

旗舰 Qwen 模型,适用于编程、推理、专业生产力和长周期自主智能体工作流。

价格
输入 $1.19 / 输出 $3.7 每 100 万 tokens

Qwen3.7-Plus

多模态 Qwen 模型,适用于编码、推理、视觉理解、工具使用,以及跨文档、屏幕和应用的交互式智能体工作流。

价格
输入 $0.32 / 输出 $1.26 每 100 万 tokens

Qwen3.8-Max

作为拥有 2.4 万亿参数的 MoE 旗舰模型,它在编程和办公能力上实现全面跃升,支持持续超过十天的自主编程并交付完整项目。它擅长法律、金融和设计等领域的数百项专业任务,通过一次端到端对话即可交付生产级结果。原生视觉理解贯穿规划、执行和验证的全过程,支持对超长文档和视频进行深层语义分析。在长期任务中,它支持自主规划和闭环迭代,并持续演进。

价格
输入 $1.9 / 输出 $5.7 每 100 万 tokens

Catalogue de modèles

Parcourir les informations et tarifs publics des modèles d’IA régis.

33 modèles disponibles

Langue

Claude-Fable-5

Modèle Claude avancé pour les agents de longue durée, le raisonnement approfondi et le travail complexe en plusieurs étapes.

Prix
Entrée $9.89 / Sortie $49.89 par million de tokens

Claude-Haiku-4.5

Modèle Claude rapide et efficace pour le codage réactif, le raisonnement et les tâches IA quotidiennes.

Prix
Entrée $0.96 / Sortie $4.89 par million de tokens

Claude-Opus-4.5

Modèle Claude très performant pour le codage complexe, les flux de travail agentiques, l’utilisation informatique et le travail professionnel fondé sur les connaissances.

Prix
Entrée $4.89 / Sortie $24.89 par million de tokens

Claude-Opus-4.6

Modèle Claude avancé pour le codage à long horizon, le raisonnement sur de grandes bases de code, le débogage, la recherche et le travail professionnel.

Prix
Entrée $4.69 / Sortie $24.89 par million de tokens

Claude-Opus-4.7

Modèle Claude avancé pour le codage, la vision, les tâches complexes à plusieurs étapes et le travail professionnel fondé sur les connaissances, avec une grande fiabilité dans les flux de travail d’agents.

Prix
Entrée $4.89 / Sortie $24.69 par million de tokens

Claude-Opus-4.8

Puissant modèle Claude pour le codage avancé, les flux de travail agentiques, le raisonnement et le travail pratique fondé sur les connaissances.

Prix
Entrée $4.89 / Sortie $24.89 par million de tokens

Claude-Sonnet-4.5

Modèle Claude équilibré pour le codage, les agents complexes, l’utilisation informatique, le raisonnement et les mathématiques.

Prix
Entrée $2.89 / Sortie $14.89 par million de tokens

Claude-Sonnet-4.6

Modèle Claude équilibré pour le codage, la planification d’agents, le raisonnement à long contexte, l’utilisation informatique et le travail professionnel.

Prix
Entrée $2.89 / Sortie $14.89 par million de tokens

Claude-Sonnet-5

Modèle Claude fortement agentique pour le codage, l’utilisation d’outils, le raisonnement et le travail professionnel, offrant une forte autonomie à la vitesse et au coût de la classe Sonnet.

Prix
Entrée $1.89 / Sortie $9.89 par million de tokens

DeepSeek-V3.2

Modèle DeepSeek efficace pour le raisonnement quotidien, le codage, la rédaction et l’assistance IA générale.

Prix
Entrée $0.2 / Sortie $0.3 par million de tokens

DeepSeek-V3.2-Thinking

Modèle DeepSeek axé sur le raisonnement pour l’analyse complexe, la résolution de problèmes étape par étape et les réponses réfléchies.

Prix
Entrée $0.42 / Sortie $0.85 par million de tokens

DeepSeek-V4-Flash

Modèle DeepSeek V4 à haut rendement pour le codage, le raisonnement et les flux de travail d’agents, avec un contexte de 1 million de tokens, des modes avec ou sans réflexion, des appels d’outils et des sorties JSON.

Prix
Entrée $0.133 / Sortie $0.266 par million de tokens

DeepSeek-V4-Flash-0731

DeepSeek-V4-Flash-0731 est la version officielle de DeepSeek V4 Flash ; elle conserve l’architecture de 284B paramètres, dont 13B de paramètres actifs, de la version preview, tout en renforçant sensiblement les capacités des agents grâce à un post-entraînement mis à jour. Elle prend en charge une fenêtre de contexte de 1M tokens, jusqu’à 384K tokens en sortie, les modes avec et sans réflexion (réflexion par défaut), la sortie JSON, les appels d’outils, la prise en charge native de l’API Responses et les workflows d’agents de codage orientés Codex.

Prix
Entrée $0.14 / Sortie $0.29 par million de tokens

DeepSeek-V4-Pro

Modèle DeepSeek pour le raisonnement complexe, le codage, l’analyse et les tâches textuelles professionnelles.

Prix
Entrée $0.43 / Sortie $0.86 par million de tokens

GLM-5-Turbo

Modèle GLM rapide pour les tâches IA quotidiennes, l’assistance au codage, l’utilisation d’outils et les conversations réactives.

Prix
Entrée $1.15 / Sortie $3.85 par million de tokens

GLM-5.1

Modèle GLM phare pour le codage agentique de longue durée et les travaux d’ingénierie complexes, avec planification, exécution, utilisation d’outils et optimisation itérative continues.

Prix
Entrée $1.33 / Sortie $4.18 par million de tokens

GLM-5.2

Modèle GLM phare pour le codage de longue durée, l’ingénierie complexe et les flux de travail d’agents autonomes, avec un contexte de 1 million de tokens et un effort de raisonnement modulable.

Prix
Entrée $1.33 / Sortie $4.18 par million de tokens
Contexte
1 000 000 tokens

GPT-5.4

Modèle GPT performant pour le codage, le raisonnement, l’utilisation d’outils et le travail professionnel complexe.

Prix
Entrée $2.38 / Sortie $14.25 par million de tokens

GPT-5.5

Modèle GPT de pointe pour le codage complexe, le travail agentique persistant, l’utilisation fiable d’outils et les tâches professionnelles.

Prix
Entrée $4.89 / Sortie $29.89 par million de tokens

GPT-5.6-Luna

Modèle GPT-5.6 efficace pour les charges de travail de raisonnement, de codage et d’agents à grand volume et sensibles aux coûts.

Prix
Entrée $0.19 / Sortie $1.14 par million de tokens

GPT-5.6-Sol

Modèle GPT-5.6 de pointe pour le raisonnement complexe, le codage, les sciences, la cybersécurité et le travail agentique à long horizon.

Prix
Entrée $4.96 / Sortie $29.89 par million de tokens

GPT-5.6-Terra

Modèle GPT-5.6 équilibré pour le raisonnement, le codage, l’utilisation d’outils et le travail professionnel quotidien.

Prix
Entrée $1.89 / Sortie $11.89 par million de tokens

Kimi-K2.5

Modèle Kimi multimodal natif pour le raisonnement, le codage, la compréhension visuelle et les flux de travail d’agents, avec des capacités coordonnées d’agents parallèles.

Prix
Entrée $0.36 / Sortie $1.95 par million de tokens

Kimi-K2.6

Modèle Kimi multimodal natif pour le codage avancé, le raisonnement et les flux de travail d’agents de longue durée, avec une utilisation robuste des outils et une exécution parallèle d’agents.

Prix
Entrée $0.9 / Sortie $3.8 par million de tokens

Kimi-K3

Kimi K3 est le premier modèle à poids ouverts au monde de niveau 3T, doté de 2,8 mille milliards de paramètres. Il est conçu pour des tâches intelligentes de pointe telles que la programmation de longue durée, le travail fondé sur les connaissances et le raisonnement, prend nativement en charge les capacités visuelles et offre une fenêtre de contexte de 1 million de tokens.

Prix
Entrée $2.75 / Sortie $13.3 par million de tokens

MiniMax-M2.5

Modèle MiniMax pour le chat, le codage, le travail de bureau et les tâches agentiques.

Prix
Entrée $0.145 / Sortie $0.88 par million de tokens

MiniMax-M2.7

Modèle MiniMax pour le chat, le codage, le travail de bureau et les tâches agentiques.

Prix
Entrée $0.285 / Sortie $1.14 par million de tokens

MiniMax-M3

Modèle MiniMax de pointe pour le codage et les flux de travail d’agents, combinant un contexte de 1 million de tokens, la multimodalité native, l’utilisation d’outils et l’exécution de longue durée.

Prix
Entrée $0.29 / Sortie $1.15 par million de tokens

Qwen3.6-27B

Modèle vision-langage Qwen pour le raisonnement visuel, les documents et les tâches d’agents.

Prix
Entrée $0.25 / Sortie $1.85 par million de tokens

Qwen3.6-Plus

Modèle Qwen vision-langage natif pour le codage agentique, le raisonnement, la compréhension visuelle, le travail documentaire et les flux de travail assistés par outils.

Prix
Entrée $0.31 / Sortie $1.85 par million de tokens

Qwen3.7-Max

Modèle Qwen phare pour la programmation, le raisonnement, la productivité professionnelle et les flux de travail d’agents autonomes de longue durée.

Prix
Entrée $1.19 / Sortie $3.7 par million de tokens

Qwen3.7-Plus

Modèle Qwen multimodal pour le codage, le raisonnement, la compréhension visuelle, l’utilisation d’outils et les flux de travail d’agents interactifs sur des documents, des écrans et des applications.

Prix
Entrée $0.32 / Sortie $1.26 par million de tokens

Qwen3.8-Max

Le modèle phare MoE, doté de 2,4 billions de paramètres, apporte un saut global des capacités de programmation et de bureautique, permettant plus de dix jours de programmation autonome afin de livrer des projets complets. Il excelle dans des centaines de tâches professionnelles dans des domaines tels que le droit, la finance et le design, en produisant des résultats de niveau production au moyen d’un seul dialogue de bout en bout. La compréhension visuelle native imprègne l’ensemble du processus de planification, d’exécution et de vérification, et prend en charge l’analyse sémantique approfondie de documents et de vidéos ultra-longs. Dans les tâches de longue durée, il permet la planification autonome et l’itération en boucle fermée, en évoluant continuellement.

Prix
Entrée $1.9 / Sortie $5.7 par million de tokens

Catálogo de modelos

Explorar información y precios públicos de modelos de IA regulados.

33 modelos disponibles

Idioma

Claude-Fable-5

Modelo Claude avanzado para agentes de larga duración, razonamiento profundo y trabajo complejo de varios pasos.

Precio
Entrada $9.89 / Salida $49.89 por 1 M de tokens

Claude-Haiku-4.5

Modelo Claude rápido y eficiente para programación ágil, razonamiento y tareas cotidianas de IA.

Precio
Entrada $0.96 / Salida $4.89 por 1 M de tokens

Claude-Opus-4.5

Modelo Claude de alta capacidad para programación compleja, flujos de trabajo de agentes, uso de computadoras y trabajo profesional basado en conocimientos.

Precio
Entrada $4.89 / Salida $24.89 por 1 M de tokens

Claude-Opus-4.6

Modelo Claude avanzado para programación de largo alcance, razonamiento sobre grandes bases de código, depuración, investigación y trabajo profesional.

Precio
Entrada $4.69 / Salida $24.89 por 1 M de tokens

Claude-Opus-4.7

Modelo Claude avanzado para programación, visión, tareas complejas de varios pasos y trabajo profesional basado en conocimiento, con gran fiabilidad en flujos de trabajo de agentes.

Precio
Entrada $4.89 / Salida $24.69 por 1 M de tokens

Claude-Opus-4.8

Potente modelo Claude para programación avanzada, flujos de trabajo de agentes, razonamiento y trabajo práctico basado en conocimientos.

Precio
Entrada $4.89 / Salida $24.89 por 1 M de tokens

Claude-Sonnet-4.5

Modelo Claude equilibrado para programación, agentes complejos, uso de computadoras, razonamiento y matemáticas.

Precio
Entrada $2.89 / Salida $14.89 por 1 M de tokens

Claude-Sonnet-4.6

Modelo Claude equilibrado para programación, planificación de agentes, razonamiento de contexto largo, uso de computadoras y trabajo profesional.

Precio
Entrada $2.89 / Salida $14.89 por 1 M de tokens

Claude-Sonnet-5

Modelo Claude altamente agéntico para programación, uso de herramientas, razonamiento y trabajo profesional, con gran autonomía a velocidad y costo de la clase Sonnet.

Precio
Entrada $1.89 / Salida $9.89 por 1 M de tokens

DeepSeek-V3.2

Modelo DeepSeek eficiente para razonamiento diario, programación, redacción y asistencia general de IA.

Precio
Entrada $0.2 / Salida $0.3 por 1 M de tokens

DeepSeek-V3.2-Thinking

Modelo DeepSeek centrado en razonamiento para análisis complejo, resolución de problemas paso a paso y respuestas reflexivas.

Precio
Entrada $0.42 / Salida $0.85 por 1 M de tokens

DeepSeek-V4-Flash

Modelo DeepSeek V4 de alta eficiencia para programación, razonamiento y flujos de trabajo de agentes, con contexto de 1 millón de tokens, modos con y sin razonamiento, llamadas a herramientas y salida JSON.

Precio
Entrada $0.133 / Salida $0.266 por 1 M de tokens

DeepSeek-V4-Flash-0731

DeepSeek-V4-Flash-0731 es la versión oficial de DeepSeek V4 Flash; conserva la arquitectura de 284B parámetros con 13B parámetros activos de la versión preliminar, a la vez que refuerza significativamente las capacidades de los agentes mediante un postentrenamiento actualizado. Admite una ventana de contexto de 1M tokens, hasta 384K de salida, modos con y sin razonamiento (razonamiento por defecto), salida JSON, llamadas a herramientas, compatibilidad nativa con la API Responses y flujos de trabajo de agentes de codificación orientados a Codex.

Precio
Entrada $0.14 / Salida $0.29 por 1 M de tokens

DeepSeek-V4-Pro

Modelo DeepSeek para razonamiento complejo, programación, análisis y tareas profesionales de texto.

Precio
Entrada $0.43 / Salida $0.86 por 1 M de tokens

GLM-5-Turbo

Modelo GLM rápido para tareas diarias de IA, asistencia de programación, uso de herramientas y conversaciones ágiles.

Precio
Entrada $1.15 / Salida $3.85 por 1 M de tokens

GLM-5.1

Modelo GLM insignia para programación agéntica de largo alcance y trabajos complejos de ingeniería, con planificación, ejecución, uso de herramientas y optimización iterativa sostenidos.

Precio
Entrada $1.33 / Salida $4.18 por 1 M de tokens

GLM-5.2

Modelo GLM insignia para programación de largo alcance, ingeniería compleja y flujos de trabajo de agentes autónomos, con una ventana de contexto de 1 millón de tokens y esfuerzo de razonamiento flexible.

Precio
Entrada $1.33 / Salida $4.18 por 1 M de tokens
Contexto
1.000.000 tokens

GPT-5.4

Modelo GPT capaz para programación, razonamiento, uso de herramientas y trabajo profesional complejo.

Precio
Entrada $2.38 / Salida $14.25 por 1 M de tokens

GPT-5.5

Modelo GPT de frontera para programación compleja, trabajo persistente de agentes, uso fiable de herramientas y tareas profesionales.

Precio
Entrada $4.89 / Salida $29.89 por 1 M de tokens

GPT-5.6-Luna

Modelo GPT-5.6 eficiente para cargas de trabajo de razonamiento, programación y agentes de alto volumen y sensibles al costo.

Precio
Entrada $0.19 / Salida $1.14 por 1 M de tokens

GPT-5.6-Sol

Modelo GPT-5.6 de frontera para razonamiento complejo, programación, ciencia, ciberseguridad y trabajo de agentes de largo alcance.

Precio
Entrada $4.96 / Salida $29.89 por 1 M de tokens

GPT-5.6-Terra

Modelo GPT-5.6 equilibrado para razonamiento capaz, programación, uso de herramientas y trabajo profesional cotidiano.

Precio
Entrada $1.89 / Salida $11.89 por 1 M de tokens

Kimi-K2.5

Modelo Kimi multimodal nativo para razonamiento, programación, comprensión visual y flujos de trabajo de agentes, con capacidades coordinadas de agentes paralelos.

Precio
Entrada $0.36 / Salida $1.95 por 1 M de tokens

Kimi-K2.6

Modelo Kimi multimodal nativo para programación avanzada, razonamiento y flujos de trabajo de agentes de largo alcance, con sólido uso de herramientas y ejecución paralela de agentes.

Precio
Entrada $0.9 / Salida $3.8 por 1 M de tokens

Kimi-K3

Kimi K3 es el primer modelo de pesos abiertos del mundo de nivel 3T, con 2,8 billones de parámetros. Está diseñado para tareas inteligentes de vanguardia como la programación de larga duración, el trabajo basado en conocimiento y el razonamiento; admite capacidades visuales de forma nativa y cuenta con una ventana de contexto de 1 millón de tokens.

Precio
Entrada $2.75 / Salida $13.3 por 1 M de tokens

MiniMax-M2.5

Modelo MiniMax para chat, programación, trabajo de oficina y tareas de agentes.

Precio
Entrada $0.145 / Salida $0.88 por 1 M de tokens

MiniMax-M2.7

Modelo MiniMax para chat, programación, trabajo de oficina y tareas de agentes.

Precio
Entrada $0.285 / Salida $1.14 por 1 M de tokens

MiniMax-M3

Modelo MiniMax de frontera para programación y flujos de trabajo de agentes, que combina una ventana de contexto de 1 millón de tokens, multimodalidad nativa, uso de herramientas y ejecución de largo alcance.

Precio
Entrada $0.29 / Salida $1.15 por 1 M de tokens

Qwen3.6-27B

Modelo de visión y lenguaje Qwen para razonamiento visual, documentos y tareas de agentes.

Precio
Entrada $0.25 / Salida $1.85 por 1 M de tokens

Qwen3.6-Plus

Modelo Qwen nativo de visión y lenguaje para programación agéntica, razonamiento, comprensión visual, trabajo documental y flujos de trabajo con herramientas.

Precio
Entrada $0.31 / Salida $1.85 por 1 M de tokens

Qwen3.7-Max

Modelo Qwen insignia para programación, razonamiento, productividad profesional y flujos de trabajo de agentes autónomos de largo alcance.

Precio
Entrada $1.19 / Salida $3.7 por 1 M de tokens

Qwen3.7-Plus

Modelo Qwen multimodal para programación, razonamiento, comprensión visual, uso de herramientas y flujos de trabajo de agentes interactivos en documentos, pantallas y aplicaciones.

Precio
Entrada $0.32 / Salida $1.26 por 1 M de tokens

Qwen3.8-Max

El modelo insignia MoE, con 2,4 billones de parámetros, ofrece un salto integral en capacidades de programación y oficina, permitiendo más de diez días de programación autónoma para entregar proyectos completos. Destaca en cientos de tareas profesionales de ámbitos como el derecho, las finanzas y el diseño, y ofrece resultados de nivel de producción mediante un único diálogo integral de extremo a extremo. La comprensión visual nativa abarca todo el proceso de planificación, ejecución y verificación, y admite el análisis semántico profundo de documentos y vídeos ultralargos. En tareas de larga duración, permite la planificación autónoma y la iteración de ciclo cerrado, evolucionando continuamente.

Precio
Entrada $1.9 / Salida $5.7 por 1 M de tokens