Skip to main content

Modelos disponíveis

O AI Hub disponibiliza modelos com capacidades e finalidades diferentes. A tabela resume o catálogo informado:

ModeloTipoIndicado para
Qwen 3.5 9BLinguagemGeração de texto e instruções gerais
Llama 3.1 8B InstructLinguagemAssistentes, conversação e tarefas de instrução
Llama 3.3 70B Instruct FP8LinguagemGeração e instruções com modelo de maior porte
Qwen 3.6 27BLinguagemGeração e compreensão de texto
Qwen 3.6 35B-A3B FP8LinguagemGeração e compreensão de texto
Qwen 3.8 27BLinguagemGeração e compreensão de texto
Qwen 3 8BLinguagemTarefas gerais de texto e conversação
Qwen 3 Embedding 8BEmbeddingsRepresentação vetorial de texto
Qwen 3 Reranker 8BRerankerReordenação de resultados de busca
Gemma 4 12B ITLinguagemGeração e instruções
google-gemma-4-eb-itLinguagemGeração e instruções
MedGemma 27B ITLinguagem especializadaTarefas relacionadas a conteúdo médico
BGE Reranker m3RerankerReordenação de resultados de busca
Nomic Embed Text v1EmbeddingsRepresentação vetorial de texto
Whisper Large V3Áudio para textoTranscrição de áudio
Sabiazinho 4LinguagemGeração de texto com modelo treinado integralmente em português do Brasil pela maritaca.ai

Como escolher​

Comece pelo tipo de tarefa: modelos de linguagem geram ou interpretam texto; modelos de embeddings transformam texto em vetores para busca semântica; rerankers ordenam resultados candidatos por relevância; modelos de áudio transcrevem fala. Compare qualidade, latência e custo com exemplos representativos da sua aplicação antes de decidir.

O nome exibido nesta página pode não ser o identificador aceito na API. Use o identificador exato mostrado nos detalhes do modelo no console. Os preços são cobrados por milhão de tokens quando essa unidade se aplica; confira a unidade e a tarifa por modelo em Preços e cobrança.

Detalhes dos modelos​

Qwen 3.5 9B​

Modelo de linguagem para geração de texto e seguimento de instruções em tarefas gerais. Avalie-o para fluxos de conversação, respostas curtas e processamento textual.

Llama 3.1 8B Instruct​

Modelo de linguagem ajustado para seguir instruções. Pode ser avaliado em assistentes, conversação e tarefas gerais de texto.

Llama 3.3 70B Instruct FP8​

Modelo de linguagem de maior porte ajustado para instruções. Avalie-o em tarefas que exigem geração ou compreensão mais elaborada; considere custo e latência ao compará-lo com opções menores.

Qwen 3.6 27B​

Modelo de linguagem para geração e compreensão de texto. Valide o desempenho com as instruções e os dados da sua aplicação.

Qwen 3.6 35B-A3B FP8​

Modelo Qwen de linguagem com configuração indicada no nome do catálogo. Consulte os detalhes do modelo no console para confirmar parâmetros, limites e formato de uso.

Qwen 3.8 27B​

Modelo de linguagem para geração e compreensão de texto. Consulte o console para verificar capacidades e identificador de API.

Qwen 3 8B​

Modelo de linguagem para tarefas gerais de texto e conversação. É uma opção para testar fluxos de instrução e geração com um modelo de menor porte que as variantes maiores do catálogo.

Qwen 3 Embedding 8B​

Modelo de embeddings que converte texto em vetores numéricos. Use os vetores em busca semântica, recuperação de documentos e aplicações de geração aumentada por recuperação (RAG).

Qwen 3 Reranker 8B​

Modelo de reranqueamento que avalia a relevância entre uma consulta e documentos candidatos para reordenar os resultados de busca.

Gemma 4 12B IT​

Modelo de linguagem Gemma ajustado para instruções. Consulte o catálogo no console para os formatos de entrada e capacidades habilitados.

google-gemma-4-eb-it​

Modelo da família Gemma listado no catálogo. Confira no console os detalhes de capacidade e o identificador aceito pela API antes de integrar.

MedGemma 27B IT​

Modelo voltado a tarefas relacionadas a conteúdo médico. Valide os resultados e mantenha revisão profissional apropriada; a disponibilidade do modelo não substitui avaliação clínica.

BGE Reranker m3​

Modelo de reranqueamento para ordenar documentos ou resultados candidatos de acordo com sua relevância para uma consulta.

Nomic Embed Text v1​

Modelo de embeddings de texto para gerar vetores usados em busca semântica e recuperação de conteúdo.

Whisper Large V3​

Modelo de reconhecimento de fala que converte áudio em texto. Verifique no console os formatos de arquivo, limites e opções disponíveis.

Sabiazinho 4​

Modelo de linguagem do catálogo para geração de texto. Modelo treinado pela maritaca.ai integralmente em português do Brasil