# Galeria de Modelos

> A lista completa de modelos disponíveis na API LMU AI (LLMs chineses / Claude / OpenAI / Gemini / Grok). Clique no nome de um modelo para copiar seu ID e cole na configuração da sua ferramenta.

URL: https://docs.lmuai.com/pt/docs/guide/models



Abaixo estão todos os nomes de modelos que a API LMU AI suporta atualmente. **Clique em qualquer card para copiar seu ID de modelo**, depois cole-o diretamente no `settings.json`, `config.toml` ou no seletor de modelo de uma ferramenta.

<Callout type="info" title="Como usar um nome de modelo">
  Cole o ID de modelo copiado na configuração da sua ferramenta:

  * **Claude Code** → o campo `"model"` no `settings.json`
  * **Codex CLI** → `model = "..."` no `~/.codex/config.toml`
  * **Cherry Studio / extensão do VS Code** → cole no menu suspenso de modelo
</Callout>

***

## Escolha um modelo por caso de uso [#escolha-um-modelo-por-caso-de-uso]

Não tem certeza de qual modelo usar? Localize-o na tabela abaixo e copie o ID de modelo da seção correspondente.

| Caso de uso                                                                     | Modelos recomendados                                          | Por quê                                                                                                                                   |
| ------------------------------------------------------------------------------- | ------------------------------------------------------------- | ----------------------------------------------------------------------------------------------------------------------------------------- |
| Refatorações complexas, grandes mudanças entre múltiplos arquivos               | `claude-opus-5` · `gpt-6-astra`                               | Tier flagship de cada fornecedor, excelente em código e textos longos, a escolha padrão para o Claude Code / Codex                        |
| Codificação diária, correção de bugs                                            | `claude-sonnet-5` · `glm-5.3`                                 | Tier equilibrado, um meio-termo entre capacidade e velocidade, ideal para o uso frequente do dia a dia                                    |
| Tarefas leves frequentes (autocompletar, formatação, pequenas edições em massa) | `claude-haiku-4-5` · `deepseek-v4-flash` · `qwen3.8-flash`    | Tier de alta velocidade, para tarefas únicas e simples chamadas muitas vezes                                                              |
| Toolchain do Codex CLI / Codex App                                              | `gpt-5.6-sol` · `gpt-5.5`                                     | O flagship no lado do protocolo OpenAI e o padrão no template de configuração do Codex CLI                                                |
| Escrita em chinês, documentação, conversação                                    | `qwen3.8-max` · `glm-5.3` · `kimi-k3`                         | LLMs chineses com excelente compreensão de chinês a um preço menor                                                                        |
| Codificação em contextos em chinês                                              | `qwen3.7-plus` · `deepseek-v4-pro`                            | Modelos chineses voltados para código, chamáveis diretamente com o saldo da conta                                                         |
| Multimodal (entrada mista de imagem + texto)                                    | `gemini-3.1-pro-preview` · `claude-fable-5-1` · `gpt-6-astra` | Modelos nativamente multimodais, que aceitam entrada mista de imagem + texto; para geração pura de imagens, veja as APIs de imagem abaixo |

<Callout type="warn" title="Confirme duas coisas antes de escolher">
  * **A disponibilidade do modelo depende do grupo**: quais modelos você pode realmente chamar é o que a página **Modelos Disponíveis** no console mostra. Por exemplo, a série GPT exige uma assinatura GPT, ou a seleção de um grupo GPT sob cobrança por uso. &#x2A;*Isso é independente do protocolo com o qual você chama.**
  * **A Base URL deve corresponder ao protocolo**: o protocolo é decidido pelo seu cliente e SDK — a Base URL do protocolo Anthropic é **sem** `/v1`, o protocolo OpenAI **deve incluir** `/v1`, e o Gemini nativo usa `/v1beta/models/...`. Errar isso resulta em um 404 direto; veja [Protocolos de API](/pt/docs/guide/api-protocols).
</Callout>

***

## Modelos chineses [#modelos-chineses]

Excelente compreensão de chinês a um preço menor, ideal para codificação diária, documentação e conversação. Assim como Claude e GPT, **todos os modelos chineses podem ser chamados usando o saldo da conta**.

> **Protocolo**: usa por padrão o **protocolo Anthropic** · Base URL `https://api.lmuai.com` (**sem** `/v1`). Veja [Protocolos de API →](/pt/docs/guide/api-protocols)

### Alibaba · Qwen [#alibaba--qwen]

- `qwen3.8-max` — Qwen 3.8 Max — flagship（New）
- `qwen3.8-flash` — Qwen 3.8 Flash — alta velocidade（New）
- `qwen3.7-plus` — Qwen 3.7 Plus
- `qwen3.7-max` — Qwen 3.7 Max
- `qwen3.6-plus` — Qwen 3.6 Plus


### DeepSeek [#deepseek]

- `deepseek-v4-pro` — DeepSeek V4 Pro — flagship
- `deepseek-v4-flash` — DeepSeek V4 Flash — alta velocidade
- `deepseek-v3.2` — DeepSeek V3.2


### MiniMax [#minimax]

- `MiniMax-M3` — MiniMax M3（New）
- `MiniMax-M2.7` — MiniMax M2.7
- `MiniMax-M2.7-highspeed` — MiniMax M2.7 alta velocidade
- `MiniMax-M2.5` — MiniMax M2.5
- `MiniMax-M2.5-highspeed` — MiniMax M2.5 alta velocidade


### Zhipu · GLM [#zhipu--glm]

- `glm-5.3` — Zhipu GLM-5.3 — flagship（New）
- `glm-5.3-flash` — Zhipu GLM-5.3 Flash — alta velocidade（New）
- `glm-5.2` — Zhipu GLM-5.2
- `glm-5.1` — Zhipu GLM-5.1
- `glm-5` — Zhipu GLM-5


### Moonshot · Kimi [#moonshot--kimi]

- `kimi-k3` — Kimi K3 — flagship
- `kimi-k2.7-code` — Kimi K2.7 Code — codificação（New）
- `kimi-k2.6` — Kimi K2.6
- `kimi-k2.5` — Kimi K2.5


### Xiaomi · MiMo [#xiaomi--mimo]

- `mimo-v2.5-pro` — Xiaomi MiMo V2.5 Pro — flagship
- `mimo-v2.5` — Xiaomi MiMo V2.5


***

## Modelos Claude [#modelos-claude]

Os modelos oficiais da Anthropic, excelentes em código e textos longos, o padrão para o Claude Code.

> **Protocolo**: o **protocolo Anthropic** é recomendado · Base URL `https://api.lmuai.com` (sem `/v1`). O protocolo OpenAI também funciona; o backend traduz o protocolo.

- `claude-opus-5` — Claude Opus 5 — flagship
- `claude-sonnet-5` — Claude Sonnet 5 — equilibrado
- `claude-haiku-4-5` — Claude Haiku 4.5 — alta velocidade
- `claude-fable-5-1` — Claude Fable 5.1 — multimodal（New）
- `claude-opus-4-8` — Claude Opus 4.8


***

## Modelos OpenAI [#modelos-openai]

A série OpenAI GPT, para Codex CLI, Codex App e qualquer ferramenta que suporte o protocolo OpenAI.

> **Protocolo**: o **protocolo OpenAI** · Base URL `https://api.lmuai.com/v1` (**deve incluir** `/v1`).

- `gpt-6-astra` — GPT-6 Astra — flagship（New）
- `gpt-5.6-sol` — GPT-5.6 Sol — flagship
- `gpt-5.6-luna` — GPT-5.6 Luna
- `gpt-5.6-terra` — GPT-5.6 Terra
- `gpt-5.5` — GPT-5.5


***

## Modelos Google · Gemini [#modelos-google--gemini]

A série Google Gemini — nativamente multimodal, com janela de contexto ultralonga (até um milhão de tokens), ideal para entrada mista de imagem + texto e processamento de documentos longos.

> **Protocolo**: pode ser chamada com o **protocolo OpenAI** (Base URL `https://api.lmuai.com/v1`, **com** `/v1`) ou o **protocolo nativo Gemini** (`/v1beta/models/...`). Veja [Protocolos de API →](/pt/docs/guide/api-protocols)

- `gemini-3.1-pro-preview` — Gemini 3.1 Pro Preview — flagship（New）
- `gemini-3.8-flash` — Gemini 3.8 Flash — alta velocidade（New）
- `gemini-3.7-flash` — Gemini 3.7 Flash — alta velocidade
- `gemini-3.6-flash` — Gemini 3.6 Flash — alta velocidade
- `gemini-3.5-flash-lite` — Gemini 3.5 Flash Lite — leve


***

## Modelos xAI · Grok [#modelos-xai--grok]

A série xAI Grok — forte capacidade de raciocínio e multimodal, com suporte a contexto ultralongo.

> **Protocolo**: o **protocolo OpenAI** · Base URL `https://api.lmuai.com/v1` (**deve incluir** `/v1`).

- `grok-4.6` — Grok 4.6 — flagship（New）
- `grok-4.5` — Grok 4.5
- `grok-4.3` — Grok 4.3
- `grok-4.20-reasoning` — Grok 4.20 Reasoning — raciocínio
- `grok-code-fast-1` — Grok Code Fast 1 — codificação / alta velocidade


***

## Todos os IDs de modelos (texto simples) [#todos-os-ids-de-modelos-texto-simples]

<Callout type="info" title="Para busca no site e cópia em massa">
  **Série Claude**: `claude-opus-5`, `claude-sonnet-5`, `claude-haiku-4-5`, `claude-fable-5-1`, `claude-opus-4-8`

  **Série OpenAI**: `gpt-6-astra`, `gpt-5.6-sol`, `gpt-5.6-luna`, `gpt-5.6-terra`, `gpt-5.5`

  **Google Gemini**: `gemini-3.1-pro-preview`, `gemini-3.8-flash`, `gemini-3.7-flash`, `gemini-3.6-flash`, `gemini-3.5-flash-lite`

  **xAI Grok**: `grok-4.6`, `grok-4.5`, `grok-4.3`, `grok-4.20-reasoning`, `grok-code-fast-1`

  **Qwen**: `qwen3.8-max`, `qwen3.8-flash`, `qwen3.7-plus`, `qwen3.7-max`, `qwen3.6-plus`

  **DeepSeek**: `deepseek-v4-pro`, `deepseek-v4-flash`, `deepseek-v3.2`

  **MiniMax**: `MiniMax-M3`, `MiniMax-M2.7`, `MiniMax-M2.7-highspeed`, `MiniMax-M2.5`, `MiniMax-M2.5-highspeed`

  **Zhipu GLM**: `glm-5.3`, `glm-5.3-flash`, `glm-5.2`, `glm-5.1`, `glm-5`

  **Moonshot Kimi**: `kimi-k3`, `kimi-k2.7-code`, `kimi-k2.6`, `kimi-k2.5`

  **Xiaomi MiMo**: `mimo-v2.5-pro`, `mimo-v2.5`

  Para modelos de imagem, veja [GPT Image](/pt/docs/api/gpt-image), [Gemini Image](/pt/docs/api/gemini-image) e [Grok Image](/pt/docs/api/grok-image).
</Callout>

***

<Callout type="warn" title="Nota">
  * Os modelos realmente disponíveis são os que a página **Modelos Disponíveis** no console da LMU AI mostra; o intervalo pode variar por plano.
  * Se você tiver dúvidas sobre a seleção de modelos, veja a [FAQ](/pt/docs/guide/faq).
</Callout>
