Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Lista de modelos

Consulte os IDs de modelo que podem ser usados diretamente, os modelos recomendados por padrão e os cenários de uso mais comuns.

Estes são os IDs de modelo da Guishu LLM que podem ser informados e usados diretamente no momento. Recomendamos copiar os nomes dos modelos exatamente como aparecem neste artigo, sem alterar maiúsculas, minúsculas ou hífens. Para multiplicadores, preços, contexto e capacidade de reconhecimento de imagens, consulte Preços dos modelos e informações de cobrança.


Modelo recomendado por padrão

claude-sonnet-4-6

Observação: modelo recomendado pela Guishu LLM para alta concorrência; possui contexto de 1M, aceita imagens e é a opção prioritária para Agents, fluxos de trabalho, compreensão de imagens, documentos longos e scripts com alta concorrência.

claude-sonnet-4-6 é um modelo agregado de alta concorrência, otimizado pela plataforma Guishu LLM com foco em tempo de resposta, velocidade de geração de tokens, contexto de 1M, chamadas de ferramentas por Agents e compreensão de imagens. Ele é indicado como modelo padrão de uso contínuo em ferramentas como OpenClaw, Claude Code, Hermes, WorkBuddy, n8n e Coze.


IA internacional

OpenAI (principal recomendação) 🌟🌟🌟🌟🌟

gpt-5.4

Observação: principal modelo de uso geral da OpenAI; possui contexto de 1M, aceita imagens e é indicado para perguntas e respostas cotidianas, programação, documentos longos e tarefas de Agent.

gpt-5.5

Observação: modelo de alta capacidade da OpenAI; atualmente a plataforma informa contexto de 258K, com suporte a imagens, indicado para raciocínio complexo, planejamento de código, redação de alta qualidade e resultados de tarefas críticas.

gpt-5.3-codex-spark

Observação: modelo Codex para programação em tempo real; possui contexto de 128k e se destaca pela resposta rápida, sendo indicado para escrever e ajustar código simultaneamente, criar patches rápidos, refinar interfaces e executar tarefas leves de engenharia.

gpt-image-2

Observação: modelo de alta qualidade para geração e edição de imagens, cobrado por imagem, indicado para fotos de produtos, cartazes, materiais de design, capas e criações que exijam maior qualidade visual.

gpt-image-2-4k

Observação: modelo de geração de imagens em alta resolução 4K, cobrado por imagem entre 0.5 e 1 yuan, indicado para cartazes em alta definição, imagens de produtos, capas, peças finais de design e materiais visuais comerciais que exijam muitos detalhes.

Série GPT 5.6 🌟🌟🌟🌟

gpt-5.6-sol

Observação: modelo de alta capacidade da série GPT 5.6; possui contexto de 258K, aceita imagens e é indicado para perguntas complexas, programação, compreensão de documentos longos e tarefas multimodais.

gpt-5.6-terra

Observação: modelo equilibrado da série GPT 5.6; possui contexto de 258K, aceita imagens e é indicado para perguntas e respostas cotidianas, assistência com código, processamento de documentos e tarefas multimodais.

xAI / Grok 🌟🌟🌟🌟

grok-4.6

Observação: rota Grok disponível nesta plataforma. Tem contexto de 500K e um multiplicador único de 10x (cerca de ¥4 / 1 milhão de Tokens), sem faixas de preço por tamanho de contexto. É indicada para raciocínio complexo, programação, documentos longos e tarefas de Agent. O suporte a imagens ainda aguarda confirmação.

grok-4.5

Observação: modelo geral avançado xAI Grok; possui contexto de 500K, aceita imagens e é indicado para perguntas complexas, programação, compreensão de documentos longos e compreensão de imagens.

Anthropic (recomendado para tarefas complexas) 🌟🌟🌟🌟🌟

claude-haiku-4-5-20251001

Observação: modelo Claude leve e rápido; possui contexto de 256k, aceita imagens e é indicado para resumos, classificação, respostas rápidas e chamadas frequentes de baixo custo.

claude-sonnet-5

Observação: principal modelo Claude de alta capacidade da nova geração; possui contexto de 1M, aceita imagens e é indicado para raciocínio complexo, programação, Agents com várias rodadas, redação de alta qualidade e tarefas com documentos longos.

claude-fable-5

Observação: modelo Claude de capacidade máxima; possui contexto de 1M, aceita imagens e é indicado para raciocínio complexo de altíssimo valor, pesquisa aprofundada, Agents de longa duração, textos extensos e tarefas críticas de engenharia.

claude-opus-4-6

Observação: modelo Opus estável e de alta capacidade; possui contexto de 1M, aceita imagens e é indicado para raciocínio complexo, redação profissional, projetos de código e análise de documentos longos.

claude-opus-4-7

Observação: modelo aprimorado da série Opus; possui contexto de 1M, aceita imagens e é mais indicado para programação aprofundada, planejamento complexo e tarefas de análise que exigem várias rodadas de refinamento.

claude-opus-4-8

Observação: modelo avançado Opus; possui contexto de 1M, aceita imagens e é indicado para tarefas complexas de alto valor, Agents de longa duração, relatórios rigorosos e entregas de engenharia de alta qualidade.

claude-opus-5

Observação: modelo avançado Opus; possui contexto de 1M, aceita imagens e é indicado para tarefas complexas de alto valor, Agents de longa duração, relatórios rigorosos e entregas de engenharia de alta qualidade.


IA chinesa

Modelo agregado chinês (recomendado para alta concorrência) 🌟🌟🌟🌟🌟

claude-sonnet-4-6

Observação: modelo de alta concorrência recomendado com prioridade pela Guishu LLM; possui contexto de 1M, aceita imagens, responde e gera tokens rapidamente e é indicado para Agents, fluxos de trabalho, scripts de automação e chamadas em grande volume.

Tongyi Qianwen / Qwen (recomendado para contexto longo e Agents) 🌟🌟🌟🌟🌟

qwen3.6-plus

Observação: modelo Tongyi Qianwen de contexto longo e excelente custo-benefício; possui contexto de 1M, aceita imagens e é indicado para compreensão de documentos longos, leitura de repositórios de código, perguntas e respostas com bases de conhecimento, chamadas de ferramentas por Agents e trabalho multimodal.

qwen3.7-plus

Observação: modelo Agent equilibrado de nova geração do Tongyi Qianwen; possui contexto de 1M, aceita imagens e oferece recursos completos de chamada de ferramentas, sendo indicado para OpenClaw, Claude Code, Hermes, grandes bases de código, processamento de documentos e compreensão de imagens.

qwen3.7-max

Observação: principal modelo de raciocínio do Tongyi Qianwen; possui contexto de 1M e é indicado para raciocínio complexo, planejamento aprofundado de código, arquitetura de sistemas, Agents de longa duração e tarefas analíticas de alto valor; oficialmente, no momento, é classificado como modelo de raciocínio e geração de texto, sem indicação de suporte a imagens.

qwen3.8-max

Observação: a nova rota Qwen de alta capacidade disponível neste gateway. Oferece contexto de 1M e compreensão de imagens, sendo indicada para raciocínio complexo, programação, Agents de longa duração, pesquisa e tarefas multimodais. qwen3.8-max é um ID de rota da plataforma e deve ser diferenciado de qwen3-max na documentação pública da Qwen.

Meituan / LongCat (recomendado para contexto longo e Coding Agents) 🌟🌟🌟🌟

LongCat-2.0

Observação: modelo Agentic Coding de contexto longo da Meituan; possui contexto de 1M e atualmente está disponível para entrada de texto, sendo indicado para compreensão de repositórios de código, planejamento complexo, raciocínio sobre documentos longos e tarefas de Agent de longa duração.

Tencent Hunyuan 🌟🌟🌟🌟

hy3

Observação: modelo de raciocínio e Agent Tencent Hunyuan 3; possui contexto de 256K e é indicado para raciocínio em chinês, programação, compreensão de documentos longos e tarefas de automação, atualmente integrado com recursos de modelo de texto.

MiniMax (recomendado para contexto longo e Agents) 🌟🌟🌟🌟

MiniMax-M3

Observação: modelo multimodal com contexto de 1M; aceita imagens e é indicado para documentos longos, repositórios de código, Agents com várias rodadas e tarefas de chamada de ferramentas.

image-01

Observação: modelo de geração de imagens a partir de texto, cobrado por imagem; indicado para cartazes, ilustrações de artigos, imagens de produtos, avatares, materiais criativos e geração de conteúdo visual em lote.

image-01-live

Observação: recurso de geração visual dinâmica, cobrado por segundo; indicado para imagens dinâmicas, animação de personagens, conteúdo visual em tempo real e cenários criativos de vídeo.

StepFun 🌟🌟🌟🌟

step-3.7-flash

Observação: modelo rápido de linguagem visual; possui contexto de 256k, aceita imagens e é indicado para programação, conversas, busca aprimorada, compreensão de imagens e Agents leves.

ByteDance / Doubao 🌟🌟🌟🌟

doubao-seed-2.1-turbo

Observação: modelo multimodal de ótimo custo-benefício, com contexto de 128K e suporte à compreensão de imagens. Indicado para agentes, engenharia de software, compreensão de imagens e vídeos e tarefas em lote de grande escala.

Xiaomi MiMo (recomendado para contexto longo) 🌟🌟🌟🌟🌟

mimo-v2.5-pro

Observação: modelo profissional da Xiaomi; possui contexto de 1M e é indicado para textos longos, análises complexas, planejamento de código e tarefas corporativas de automação.

mimo-v2.5

Observação: modelo geral de baixo custo; possui contexto de 1M, aceita imagens e é indicado para conversas cotidianas, reescrita, resumos, processamento de documentos e tarefas em lote.

DeepSeek (recomendado para raciocínio e programação) 🌟🌟🌟🌟🌟

deepseek-v4-pro

Observação: modelo MoE de alta capacidade da DeepSeek; possui contexto de 1M e é indicado para programação, matemática, planejamento complexo, análise aprofundada e raciocínio de alta dificuldade.

deepseek-v4-flash

Observação: versão rápida e leve da DeepSeek; possui contexto de 1M e é indicada para perguntas frequentes, resumos, assistência rápida com código e tarefas de raciocínio sensíveis a custo.

Kimi (Moonshot AI) 🌟🌟🌟🌟🌟

kimi-k3

Observação: modelo multimodal Kimi de nova geração para contexto longo; possui contexto de 1M, aceita imagens e é indicado para tarefas complexas de programação e Agent, análise de documentos ultralongos, perguntas e respostas sobre conhecimento e compreensão de imagens.

Zhipu / Z.ai 🌟🌟🌟🌟

glm-5.1

Observação: principal modelo geral da Zhipu; possui contexto de 256k, aceita imagens e é indicado para redação, análise, programação, engenharia com Agents e cenários multimodais.

glm-5.2

Observação: modelo multimodal avançado de nova geração da Zhipu; possui contexto de 1M, aceita imagens e é indicado para redação complexa, análise, programação, engenharia com Agents e tarefas multimodais.


Recomendações de uso

Se você não souber qual escolher, comece pelo cenário de uso. Para o uso cotidiano, priorize modelos econômicos e estáveis; recorra aos modelos de multiplicador maior para tarefas complexas.

  • Uso cotidiano padrão / alta concorrência: claude-sonnet-4-6, gpt-5.6-terra, MiniMax-M3
  • Raciocínio complexo / resultados de alta qualidade: gpt-5.6-sol, qwen3.8-max, deepseek-v4-pro
  • Tarefas avançadas de longa duração: claude-fable-5, indicado para tarefas de Agent, programação e pesquisa realmente valiosas, prolongadas e altamente complexas
  • Iteração rápida de código: gpt-5.3-codex-spark, LongCat-2.0, qwen3.7-plus
  • Documentos com contexto longo: MiniMax-M3, qwen3.7-plus, LongCat-2.0, deepseek-v4-pro, kimi-k3, glm-5.2
  • Compreensão de imagens: priorize modelos cuja descrição indique “aceita imagens”
  • Geração de imagens: gpt-image-2, gpt-image-2-4k, image-01, image-01-live