Lista de modelos
Consulta los ID de modelo que puedes introducir directamente, los modelos recomendados de manera predeterminada y sus usos habituales.
Estos son los ID de modelo de LLM API Gateway que se pueden introducir y utilizar directamente. Se recomienda copiar los nombres de los modelos exactamente como aparecen en este documento, sin cambiar las mayúsculas, las minúsculas ni los guiones. Para consultar los multiplicadores, los precios, la ventana de contexto y la capacidad de comprensión de imágenes, revisa Precios de los modelos e información de facturación.
Modelo recomendado de manera predeterminada
claude-sonnet-4-6Descripción: modelo recomendado por LLM API Gateway para una alta concurrencia; ventana de contexto de 1M y comprensión de imágenes. Es la opción prioritaria para agentes, flujos de trabajo, comprensión de imágenes, documentos largos y scripts de alta concurrencia.
claude-sonnet-4-6 es un modelo agregado de alta concurrencia optimizado por la plataforma LLM API Gateway, con mejoras específicas en el tiempo de respuesta, la velocidad de generación, la ventana de contexto de 1M, las llamadas de los agentes a herramientas y la comprensión de imágenes. Es adecuado como modelo predeterminado a largo plazo en herramientas como OpenClaw, Claude Code, Hermes, WorkBuddy, n8n y Coze.
Modelos internacionales de IA
OpenAI (recomendación principal) 🌟🌟🌟🌟🌟
gpt-5.4Descripción: principal modelo generalista de OpenAI; ventana de contexto de 1M y comprensión de imágenes. Adecuado para consultas cotidianas, código, documentos largos y tareas de agentes.
gpt-5.5Descripción: modelo de alta capacidad de OpenAI; la plataforma indica actualmente una ventana de contexto de 258K y compatibilidad con la comprensión de imágenes. Adecuado para razonamiento complejo, planificación de código, redacción de alta calidad y resultados para tareas críticas.
gpt-5.3-codex-sparkDescripción: modelo de programación en tiempo real de Codex; ventana de contexto de 128k y respuesta rápida. Adecuado para escribir y modificar código de forma iterativa, aplicar parches rápidos, realizar pequeños ajustes de UI y abordar tareas ligeras de ingeniería.
gpt-image-2Descripción: modelo de alta calidad para generar y editar imágenes, con facturación por imagen. Adecuado para imágenes de productos, carteles, recursos de diseño, portadas y creaciones que requieran una mayor calidad visual.
gpt-image-2-4kDescripción: modelo de generación de imágenes 4K de alta resolución, con un precio de 0.5-1 yuanes por imagen. Adecuado para carteles de alta definición, imágenes de productos, portadas, piezas de diseño terminadas y elementos visuales comerciales con un alto nivel de detalle.
Serie GPT 5.6 🌟🌟🌟🌟
gpt-5.6-solDescripción: modelo de alta capacidad de la serie GPT 5.6; ventana de contexto de 258K y comprensión de imágenes. Adecuado para consultas complejas, código, comprensión de documentos largos y tareas multimodales.
gpt-5.6-terraDescripción: modelo equilibrado de la serie GPT 5.6; ventana de contexto de 258K y comprensión de imágenes. Adecuado para consultas cotidianas, asistencia con código, procesamiento de documentos y tareas multimodales.
xAI / Grok 🌟🌟🌟🌟
grok-4.6Descripción: ruta Grok disponible en esta plataforma. Ofrece una ventana de contexto de 500K y un multiplicador único de 10 (aprox. ¥4 / 1 millón de Tokens), sin tramos según la longitud del contexto. Es adecuada para razonamiento complejo, programación, documentos largos y tareas de Agent. La compatibilidad con imágenes está pendiente de confirmación.
grok-4.5Descripción: potente modelo generalista Grok de xAI; ventana de contexto de 500K y comprensión de imágenes. Adecuado para consultas complejas, código, comprensión de documentos largos y tareas de comprensión de imágenes.
Anthropic (recomendado para tareas complejas) 🌟🌟🌟🌟🌟
claude-haiku-4-5-20251001Descripción: modelo Claude ligero y rápido; ventana de contexto de 256k y comprensión de imágenes. Adecuado para resúmenes, clasificación, respuestas rápidas y llamadas frecuentes de bajo coste.
claude-sonnet-5Descripción: principal modelo de alta capacidad de la nueva generación de Claude; ventana de contexto de 1M y comprensión de imágenes. Adecuado para razonamiento complejo, código, agentes de varios turnos, redacción de alta calidad y tareas con documentos largos.
claude-fable-5Descripción: modelo Claude de máxima capacidad; ventana de contexto de 1M y comprensión de imágenes. Adecuado para razonamiento complejo de máximo valor, investigación profunda, agentes de larga duración, redacción extensa y tareas críticas de ingeniería.
claude-opus-4-6Descripción: modelo Opus estable de alta capacidad; ventana de contexto de 1M y comprensión de imágenes. Adecuado para razonamiento complejo, redacción rigurosa, diseño de soluciones de código y análisis de documentos largos.
claude-opus-4-7Descripción: modelo mejorado de la serie Opus; ventana de contexto de 1M y comprensión de imágenes. Es especialmente adecuado para programación avanzada, planificación compleja y tareas de análisis que requieran varias rondas de refinamiento.
claude-opus-4-8Descripción: modelo Opus avanzado; ventana de contexto de 1M y comprensión de imágenes. Adecuado para tareas complejas de alto valor, agentes de larga duración, informes rigurosos y entregas de ingeniería de alta calidad.
claude-opus-5Descripción: modelo Opus avanzado; ventana de contexto de 1M y comprensión de imágenes. Adecuado para tareas complejas de alto valor, agentes de larga duración, informes rigurosos y entregas de ingeniería de alta calidad.
Modelos chinos de IA
Modelo agregado chino (recomendado para alta concurrencia) 🌟🌟🌟🌟🌟
claude-sonnet-4-6Descripción: modelo de alta concurrencia especialmente recomendado por LLM API Gateway; ventana de contexto de 1M, comprensión de imágenes y gran velocidad de respuesta y generación. Adecuado para agentes, flujos de trabajo, scripts de automatización y llamadas a gran escala.
Tongyi Qianwen / Qwen (recomendado para ventanas de contexto amplias y agentes) 🌟🌟🌟🌟🌟
qwen3.6-plusDescripción: modelo de Tongyi Qianwen con una amplia ventana de contexto y una excelente relación calidad-precio; ventana de contexto de 1M y comprensión de imágenes. Adecuado para comprender documentos largos, leer repositorios de código, responder preguntas sobre bases de conocimiento, realizar llamadas a herramientas mediante agentes y trabajar en entornos de oficina multimodales.
qwen3.7-plusDescripción: modelo equilibrado de nueva generación de Tongyi Qianwen para agentes; ventana de contexto de 1M, comprensión de imágenes y funciones completas de llamada a herramientas. Adecuado para OpenClaw, Claude Code, Hermes, grandes bases de código, procesamiento de documentos y tareas de comprensión de imágenes.
qwen3.7-maxDescripción: modelo insignia de razonamiento de Tongyi Qianwen; ventana de contexto de 1M. Adecuado para razonamiento complejo, planificación avanzada de código, diseño de arquitectura, agentes de larga duración y tareas de análisis de alto valor. Actualmente, la información oficial lo clasifica como modelo de razonamiento y generación de texto, sin indicar por ahora comprensión de imágenes.
qwen3.8-maxDescripción: la nueva ruta Qwen de alta capacidad disponible en esta pasarela. Ofrece contexto de 1M y comprensión de imágenes, y es adecuada para razonamiento complejo, código, agentes de larga duración, investigación y tareas multimodales. qwen3.8-max es un ID de ruta de la plataforma; debe distinguirse de qwen3-max en la documentación pública de Qwen.
Meituan / LongCat (recomendado para ventanas de contexto amplias y agentes de programación) 🌟🌟🌟🌟
LongCat-2.0Descripción: modelo de programación con agentes de Meituan y una amplia ventana de contexto; ventana de contexto de 1M y acceso actual mediante entrada de texto. Adecuado para comprender repositorios de código, realizar planificaciones complejas, razonar sobre documentos largos y ejecutar tareas de agentes de larga duración.
Tencent Hunyuan / Hunyuan 🌟🌟🌟🌟
hy3Descripción: modelo Hunyuan 3 de Tencent para razonamiento y agentes; ventana de contexto de 256K. Adecuado para razonamiento en chino, código, comprensión de documentos largos y tareas de automatización. Actualmente está integrado con las capacidades de un modelo de texto.
MiniMax / MiniMax (recomendado para ventanas de contexto amplias y agentes) 🌟🌟🌟🌟
MiniMax-M3Descripción: modelo multimodal con una ventana de contexto de 1M; comprende imágenes y es adecuado para documentos largos, repositorios de código, agentes de varios turnos y tareas de llamada a herramientas.
image-01Descripción: modelo de generación de imágenes a partir de texto, con facturación por imagen. Adecuado para carteles, ilustraciones de artículos, imágenes de productos, avatares, recursos creativos y generación masiva de contenido visual.
image-01-liveDescripción: capacidad de generación visual dinámica con facturación por segundo. Adecuada para imágenes animadas, animaciones de personajes, elementos visuales en tiempo real y escenarios creativos relacionados con el vídeo.
StepFun 🌟🌟🌟🌟
step-3.7-flashDescripción: modelo rápido de visión y lenguaje; ventana de contexto de 256k y comprensión de imágenes. Adecuado para código, conversaciones, búsquedas mejoradas, comprensión de imágenes y agentes ligeros.
ByteDance / Doubao 🌟🌟🌟🌟
doubao-seed-2.1-turboDescripción: modelo multimodal rentable con una ventana de contexto de 128K y comprensión de imágenes. Adecuado para agentes, ingeniería de software, comprensión de imágenes y vídeo, y tareas por lotes a gran escala.
Xiaomi MiMo (recomendado para ventanas de contexto amplias) 🌟🌟🌟🌟🌟
mimo-v2.5-proDescripción: modelo profesional de Xiaomi; ventana de contexto de 1M. Adecuado para textos largos, análisis complejos, planificación de código y tareas de automatización empresarial.
mimo-v2.5Descripción: modelo generalista de bajo coste; ventana de contexto de 1M y comprensión de imágenes. Adecuado para conversaciones cotidianas, reescrituras, resúmenes, procesamiento de documentos y tareas por lotes.
DeepSeek / DeepSeek (recomendado para razonamiento y código) 🌟🌟🌟🌟🌟
deepseek-v4-proDescripción: modelo MoE de alta capacidad de DeepSeek; ventana de contexto de 1M. Adecuado para código, matemáticas, planificación compleja, análisis profundo y razonamiento de gran dificultad.
deepseek-v4-flashDescripción: versión ligera y rápida de DeepSeek; ventana de contexto de 1M. Adecuado para consultas frecuentes, resúmenes, asistencia rápida con código y tareas de razonamiento sensibles al coste.
Kimi (Moonshot AI) 🌟🌟🌟🌟🌟
kimi-k3Descripción: modelo multimodal Kimi de nueva generación con una amplia ventana de contexto de 1M y comprensión de imágenes. Adecuado para tareas complejas de código y agentes, análisis de documentos muy largos, preguntas y respuestas sobre conocimientos y comprensión de imágenes.
Zhipu / Z.ai 🌟🌟🌟🌟
glm-5.1Descripción: modelo generalista insignia de Zhipu; ventana de contexto de 256k y comprensión de imágenes. Adecuado para redacción, análisis, código, ingeniería con agentes y escenarios multimodales.
glm-5.2Descripción: potente modelo multimodal de nueva generación de Zhipu; ventana de contexto de 1M y comprensión de imágenes. Adecuado para redacción compleja, análisis, código, ingeniería con agentes y tareas multimodales.
Recomendaciones de uso
Si no sabes cuál elegir, empieza por el tipo de tarea. Para el uso cotidiano, prioriza modelos económicos y estables; reserva los modelos con un multiplicador alto para las tareas complejas.
- Uso cotidiano predeterminado / alta concurrencia:
claude-sonnet-4-6,gpt-5.6-terra,MiniMax-M3 - Razonamiento complejo / resultados de alta calidad:
gpt-5.6-sol,qwen3.8-max,deepseek-v4-pro - Tareas de larga duración del máximo nivel:
claude-fable-5, adecuado para tareas de agentes / código / investigación de gran valor, larga duración y alta complejidad - Iteración rápida de código:
gpt-5.3-codex-spark,LongCat-2.0,qwen3.7-plus - Documentos con ventanas de contexto amplias:
MiniMax-M3,qwen3.7-plus,LongCat-2.0,deepseek-v4-pro,kimi-k3,glm-5.2 - Comprensión de imágenes: prioriza los modelos cuya descripción indique «comprensión de imágenes»
- Generación de imágenes:
gpt-image-2,gpt-image-2-4k,image-01,image-01-live