Como escolher o melhor modelo
- Verificação de suporte a ferramentas (Tool Calling) e streaming
- Comparação de custos entre tokens de entrada e saída
- Adequação da janela de contexto para sua aplicação
- Monitoramento do status de operação em tempo real
Informações verificadas no catálogo
As especificações e preços reais dos modelos são sempre baseados no catálogo ao vivo exibido abaixo.
Catálogo de modelos
| Modelo | Entrada / 1 mi de tokens | Saída / 1 mi de tokens | Contexto | Status |
|---|---|---|---|---|
| qwen-vl-plus | CNY 1 | CNY 2.5 | 131K | Disponível |
| qwen3.5-flash | CNY 0.25 | CNY 2.4 | 1M | Disponível |
| qwen3.6-flash | CNY 1.45 | CNY 8.65 | 1M | Disponível |
| qwen3.7-plus | CNY 2.4 | CNY 9.6 | 1M | Disponível |
| qwen3.7-max | CNY 14.4 | CNY 43.2 | 1M | Disponível |
Perguntas frequentes
Posso usar o SDK da OpenAI?
Sim, para o subconjunto verificado de Chat Completions. Configure a URL base, a chave API e o modelo; parâmetros não aceitos retornam erro explícito.
Todos os modelos oferecem streaming e suporte a ferramentas?
Os recursos (como chamadas de função ou streaming) dependem de cada modelo. Você pode consultar as especificações em tempo real no nosso catálogo ativo.