- Início
- Inteligência Artificial
- AI Hub
- Modelos disponíveis
Modelos disponíveis
O AI Hub disponibiliza modelos com capacidades e finalidades diferentes. A tabela resume o catálogo informado:
| Modelo | Tipo | Indicado para |
|---|---|---|
| Qwen 3.5 9B | Linguagem | Geração de texto e instruções gerais |
| Llama 3.1 8B Instruct | Linguagem | Assistentes, conversação e tarefas de instrução |
| Llama 3.3 70B Instruct FP8 | Linguagem | Geração e instruções com modelo de maior porte |
| Qwen 3.6 27B | Linguagem | Geração e compreensão de texto |
| Qwen 3.6 35B-A3B FP8 | Linguagem | Geração e compreensão de texto |
| Qwen 3.8 27B | Linguagem | Geração e compreensão de texto |
| Qwen 3 8B | Linguagem | Tarefas gerais de texto e conversação |
| Qwen 3 Embedding 8B | Embeddings | Representação vetorial de texto |
| Qwen 3 Reranker 8B | Reranker | Reordenação de resultados de busca |
| Gemma 4 12B IT | Linguagem | Geração e instruções |
| google-gemma-4-eb-it | Linguagem | Geração e instruções |
| MedGemma 27B IT | Linguagem especializada | Tarefas relacionadas a conteúdo médico |
| BGE Reranker m3 | Reranker | Reordenação de resultados de busca |
| Nomic Embed Text v1 | Embeddings | Representação vetorial de texto |
| Whisper Large V3 | Áudio para texto | Transcrição de áudio |
| Sabiazinho 4 | Linguagem | Geração de texto com modelo treinado integralmente em português do Brasil pela maritaca.ai |
Como escolher
Comece pelo tipo de tarefa: modelos de linguagem geram ou interpretam texto; modelos de embeddings transformam texto em vetores para busca semântica; rerankers ordenam resultados candidatos por relevância; modelos de áudio transcrevem fala. Compare qualidade, latência e custo com exemplos representativos da sua aplicação antes de decidir.
O nome exibido nesta página pode não ser o identificador aceito na API. Use o identificador exato mostrado nos detalhes do modelo no console. Os preços são cobrados por milhão de tokens quando essa unidade se aplica; confira a unidade e a tarifa por modelo em Preços e cobrança.
Detalhes dos modelos
Qwen 3.5 9B
Modelo de linguagem para geração de texto e seguimento de instruções em tarefas gerais. Avalie-o para fluxos de conversação, respostas curtas e processamento textual.
Llama 3.1 8B Instruct
Modelo de linguagem ajustado para seguir instruções. Pode ser avaliado em assistentes, conversação e tarefas gerais de texto.
Llama 3.3 70B Instruct FP8
Modelo de linguagem de maior porte ajustado para instruções. Avalie-o em tarefas que exigem geração ou compreensão mais elaborada; considere custo e latência ao compará-lo com opções menores.
Qwen 3.6 27B
Modelo de linguagem para geração e compreensão de texto. Valide o desempenho com as instruções e os dados da sua aplicação.
Qwen 3.6 35B-A3B FP8
Modelo Qwen de linguagem com configuração indicada no nome do catálogo. Consulte os detalhes do modelo no console para confirmar parâmetros, limites e formato de uso.
Qwen 3.8 27B
Modelo de linguagem para geração e compreensão de texto. Consulte o console para verificar capacidades e identificador de API.
Qwen 3 8B
Modelo de linguagem para tarefas gerais de texto e conversação. É uma opção para testar fluxos de instrução e geração com um modelo de menor porte que as variantes maiores do catálogo.
Qwen 3 Embedding 8B
Modelo de embeddings que converte texto em vetores numéricos. Use os vetores em busca semântica, recuperação de documentos e aplicações de geração aumentada por recuperação (RAG).
Qwen 3 Reranker 8B
Modelo de reranqueamento que avalia a relevância entre uma consulta e documentos candidatos para reordenar os resultados de busca.
Gemma 4 12B IT
Modelo de linguagem Gemma ajustado para instruções. Consulte o catálogo no console para os formatos de entrada e capacidades habilitados.
google-gemma-4-eb-it
Modelo da família Gemma listado no catálogo. Confira no console os detalhes de capacidade e o identificador aceito pela API antes de integrar.
MedGemma 27B IT
Modelo voltado a tarefas relacionadas a conteúdo médico. Valide os resultados e mantenha revisão profissional apropriada; a disponibilidade do modelo não substitui avaliação clínica.
BGE Reranker m3
Modelo de reranqueamento para ordenar documentos ou resultados candidatos de acordo com sua relevância para uma consulta.
Nomic Embed Text v1
Modelo de embeddings de texto para gerar vetores usados em busca semântica e recuperação de conteúdo.
Whisper Large V3
Modelo de reconhecimento de fala que converte áudio em texto. Verifique no console os formatos de arquivo, limites e opções disponíveis.
Sabiazinho 4
Modelo de linguagem do catálogo para geração de texto. Modelo treinado pela maritaca.ai integralmente em português do Brasil