Lista de modelos
Consulte os IDs de modelo que podem ser usados diretamente, os modelos recomendados por padrão e os cenários de uso mais comuns.
Estes são os IDs de modelo da Guishu LLM que podem ser informados e usados diretamente no momento. Recomendamos copiar os nomes dos modelos exatamente como aparecem neste artigo, sem alterar maiúsculas, minúsculas ou hífens. Para multiplicadores, preços, contexto e capacidade de reconhecimento de imagens, consulte Preços dos modelos e informações de cobrança.
Modelo recomendado por padrão
claude-sonnet-4-6Observação: modelo recomendado pela Guishu LLM para alta concorrência; possui contexto de 1M, aceita imagens e é a opção prioritária para Agents, fluxos de trabalho, compreensão de imagens, documentos longos e scripts com alta concorrência.
claude-sonnet-4-6 é um modelo agregado de alta concorrência, otimizado pela plataforma Guishu LLM com foco em tempo de resposta, velocidade de geração de tokens, contexto de 1M, chamadas de ferramentas por Agents e compreensão de imagens. Ele é indicado como modelo padrão de uso contínuo em ferramentas como OpenClaw, Claude Code, Hermes, WorkBuddy, n8n e Coze.
IA internacional
OpenAI (principal recomendação) 🌟🌟🌟🌟🌟
gpt-5.4Observação: principal modelo de uso geral da OpenAI; possui contexto de 1M, aceita imagens e é indicado para perguntas e respostas cotidianas, programação, documentos longos e tarefas de Agent.
gpt-5.5Observação: modelo de alta capacidade da OpenAI; atualmente a plataforma informa contexto de 258K, com suporte a imagens, indicado para raciocínio complexo, planejamento de código, redação de alta qualidade e resultados de tarefas críticas.
gpt-5.3-codex-sparkObservação: modelo Codex para programação em tempo real; possui contexto de 128k e se destaca pela resposta rápida, sendo indicado para escrever e ajustar código simultaneamente, criar patches rápidos, refinar interfaces e executar tarefas leves de engenharia.
gpt-image-2Observação: modelo de alta qualidade para geração e edição de imagens, cobrado por imagem, indicado para fotos de produtos, cartazes, materiais de design, capas e criações que exijam maior qualidade visual.
gpt-image-2-4kObservação: modelo de geração de imagens em alta resolução 4K, cobrado por imagem entre 0.5 e 1 yuan, indicado para cartazes em alta definição, imagens de produtos, capas, peças finais de design e materiais visuais comerciais que exijam muitos detalhes.
Série GPT 5.6 🌟🌟🌟🌟
gpt-5.6-solObservação: modelo de alta capacidade da série GPT 5.6; possui contexto de 258K, aceita imagens e é indicado para perguntas complexas, programação, compreensão de documentos longos e tarefas multimodais.
gpt-5.6-terraObservação: modelo equilibrado da série GPT 5.6; possui contexto de 258K, aceita imagens e é indicado para perguntas e respostas cotidianas, assistência com código, processamento de documentos e tarefas multimodais.
xAI / Grok 🌟🌟🌟🌟
grok-4.6Observação: rota Grok disponível nesta plataforma. Tem contexto de 500K e um multiplicador único de 10x (cerca de ¥4 / 1 milhão de Tokens), sem faixas de preço por tamanho de contexto. É indicada para raciocínio complexo, programação, documentos longos e tarefas de Agent. O suporte a imagens ainda aguarda confirmação.
grok-4.5Observação: modelo geral avançado xAI Grok; possui contexto de 500K, aceita imagens e é indicado para perguntas complexas, programação, compreensão de documentos longos e compreensão de imagens.
Anthropic (recomendado para tarefas complexas) 🌟🌟🌟🌟🌟
claude-haiku-4-5-20251001Observação: modelo Claude leve e rápido; possui contexto de 256k, aceita imagens e é indicado para resumos, classificação, respostas rápidas e chamadas frequentes de baixo custo.
claude-sonnet-5Observação: principal modelo Claude de alta capacidade da nova geração; possui contexto de 1M, aceita imagens e é indicado para raciocínio complexo, programação, Agents com várias rodadas, redação de alta qualidade e tarefas com documentos longos.
claude-fable-5Observação: modelo Claude de capacidade máxima; possui contexto de 1M, aceita imagens e é indicado para raciocínio complexo de altíssimo valor, pesquisa aprofundada, Agents de longa duração, textos extensos e tarefas críticas de engenharia.
claude-opus-4-6Observação: modelo Opus estável e de alta capacidade; possui contexto de 1M, aceita imagens e é indicado para raciocínio complexo, redação profissional, projetos de código e análise de documentos longos.
claude-opus-4-7Observação: modelo aprimorado da série Opus; possui contexto de 1M, aceita imagens e é mais indicado para programação aprofundada, planejamento complexo e tarefas de análise que exigem várias rodadas de refinamento.
claude-opus-4-8Observação: modelo avançado Opus; possui contexto de 1M, aceita imagens e é indicado para tarefas complexas de alto valor, Agents de longa duração, relatórios rigorosos e entregas de engenharia de alta qualidade.
claude-opus-5Observação: modelo avançado Opus; possui contexto de 1M, aceita imagens e é indicado para tarefas complexas de alto valor, Agents de longa duração, relatórios rigorosos e entregas de engenharia de alta qualidade.
IA chinesa
Modelo agregado chinês (recomendado para alta concorrência) 🌟🌟🌟🌟🌟
claude-sonnet-4-6Observação: modelo de alta concorrência recomendado com prioridade pela Guishu LLM; possui contexto de 1M, aceita imagens, responde e gera tokens rapidamente e é indicado para Agents, fluxos de trabalho, scripts de automação e chamadas em grande volume.
Tongyi Qianwen / Qwen (recomendado para contexto longo e Agents) 🌟🌟🌟🌟🌟
qwen3.6-plusObservação: modelo Tongyi Qianwen de contexto longo e excelente custo-benefício; possui contexto de 1M, aceita imagens e é indicado para compreensão de documentos longos, leitura de repositórios de código, perguntas e respostas com bases de conhecimento, chamadas de ferramentas por Agents e trabalho multimodal.
qwen3.7-plusObservação: modelo Agent equilibrado de nova geração do Tongyi Qianwen; possui contexto de 1M, aceita imagens e oferece recursos completos de chamada de ferramentas, sendo indicado para OpenClaw, Claude Code, Hermes, grandes bases de código, processamento de documentos e compreensão de imagens.
qwen3.7-maxObservação: principal modelo de raciocínio do Tongyi Qianwen; possui contexto de 1M e é indicado para raciocínio complexo, planejamento aprofundado de código, arquitetura de sistemas, Agents de longa duração e tarefas analíticas de alto valor; oficialmente, no momento, é classificado como modelo de raciocínio e geração de texto, sem indicação de suporte a imagens.
qwen3.8-maxObservação: a nova rota Qwen de alta capacidade disponível neste gateway. Oferece contexto de 1M e compreensão de imagens, sendo indicada para raciocínio complexo, programação, Agents de longa duração, pesquisa e tarefas multimodais. qwen3.8-max é um ID de rota da plataforma e deve ser diferenciado de qwen3-max na documentação pública da Qwen.
Meituan / LongCat (recomendado para contexto longo e Coding Agents) 🌟🌟🌟🌟
LongCat-2.0Observação: modelo Agentic Coding de contexto longo da Meituan; possui contexto de 1M e atualmente está disponível para entrada de texto, sendo indicado para compreensão de repositórios de código, planejamento complexo, raciocínio sobre documentos longos e tarefas de Agent de longa duração.
Tencent Hunyuan 🌟🌟🌟🌟
hy3Observação: modelo de raciocínio e Agent Tencent Hunyuan 3; possui contexto de 256K e é indicado para raciocínio em chinês, programação, compreensão de documentos longos e tarefas de automação, atualmente integrado com recursos de modelo de texto.
MiniMax (recomendado para contexto longo e Agents) 🌟🌟🌟🌟
MiniMax-M3Observação: modelo multimodal com contexto de 1M; aceita imagens e é indicado para documentos longos, repositórios de código, Agents com várias rodadas e tarefas de chamada de ferramentas.
image-01Observação: modelo de geração de imagens a partir de texto, cobrado por imagem; indicado para cartazes, ilustrações de artigos, imagens de produtos, avatares, materiais criativos e geração de conteúdo visual em lote.
image-01-liveObservação: recurso de geração visual dinâmica, cobrado por segundo; indicado para imagens dinâmicas, animação de personagens, conteúdo visual em tempo real e cenários criativos de vídeo.
StepFun 🌟🌟🌟🌟
step-3.7-flashObservação: modelo rápido de linguagem visual; possui contexto de 256k, aceita imagens e é indicado para programação, conversas, busca aprimorada, compreensão de imagens e Agents leves.
ByteDance / Doubao 🌟🌟🌟🌟
doubao-seed-2.1-turboObservação: modelo multimodal de ótimo custo-benefício, com contexto de 128K e suporte à compreensão de imagens. Indicado para agentes, engenharia de software, compreensão de imagens e vídeos e tarefas em lote de grande escala.
Xiaomi MiMo (recomendado para contexto longo) 🌟🌟🌟🌟🌟
mimo-v2.5-proObservação: modelo profissional da Xiaomi; possui contexto de 1M e é indicado para textos longos, análises complexas, planejamento de código e tarefas corporativas de automação.
mimo-v2.5Observação: modelo geral de baixo custo; possui contexto de 1M, aceita imagens e é indicado para conversas cotidianas, reescrita, resumos, processamento de documentos e tarefas em lote.
DeepSeek (recomendado para raciocínio e programação) 🌟🌟🌟🌟🌟
deepseek-v4-proObservação: modelo MoE de alta capacidade da DeepSeek; possui contexto de 1M e é indicado para programação, matemática, planejamento complexo, análise aprofundada e raciocínio de alta dificuldade.
deepseek-v4-flashObservação: versão rápida e leve da DeepSeek; possui contexto de 1M e é indicada para perguntas frequentes, resumos, assistência rápida com código e tarefas de raciocínio sensíveis a custo.
Kimi (Moonshot AI) 🌟🌟🌟🌟🌟
kimi-k3Observação: modelo multimodal Kimi de nova geração para contexto longo; possui contexto de 1M, aceita imagens e é indicado para tarefas complexas de programação e Agent, análise de documentos ultralongos, perguntas e respostas sobre conhecimento e compreensão de imagens.
Zhipu / Z.ai 🌟🌟🌟🌟
glm-5.1Observação: principal modelo geral da Zhipu; possui contexto de 256k, aceita imagens e é indicado para redação, análise, programação, engenharia com Agents e cenários multimodais.
glm-5.2Observação: modelo multimodal avançado de nova geração da Zhipu; possui contexto de 1M, aceita imagens e é indicado para redação complexa, análise, programação, engenharia com Agents e tarefas multimodais.
Recomendações de uso
Se você não souber qual escolher, comece pelo cenário de uso. Para o uso cotidiano, priorize modelos econômicos e estáveis; recorra aos modelos de multiplicador maior para tarefas complexas.
- Uso cotidiano padrão / alta concorrência:
claude-sonnet-4-6,gpt-5.6-terra,MiniMax-M3 - Raciocínio complexo / resultados de alta qualidade:
gpt-5.6-sol,qwen3.8-max,deepseek-v4-pro - Tarefas avançadas de longa duração:
claude-fable-5, indicado para tarefas de Agent, programação e pesquisa realmente valiosas, prolongadas e altamente complexas - Iteração rápida de código:
gpt-5.3-codex-spark,LongCat-2.0,qwen3.7-plus - Documentos com contexto longo:
MiniMax-M3,qwen3.7-plus,LongCat-2.0,deepseek-v4-pro,kimi-k3,glm-5.2 - Compreensão de imagens: priorize modelos cuja descrição indique “aceita imagens”
- Geração de imagens:
gpt-image-2,gpt-image-2-4k,image-01,image-01-live