Deepinfra
Uma forte candidata quando o modelo disponível produz resultados confiáveis no seu conjunto de avaliação.
Funciona bem
- Pode ser avaliada com os mesmos prompts específicos da tarefa e os mesmos critérios de pontuação usados para a Together AI.
- Permite que quem já usa a Deepinfra teste a qualidade sem precisar alterar o aplicativo primeiro.
- Pode atingir o nível de qualidade exigido pela tarefa, mesmo que outro provedor lidere em um benchmark não relacionado.
Pontos de atenção
- Um resultado favorável para um modelo não comprova a qualidade dos demais modelos do catálogo.
- Diferenças nas versões dos modelos ou nas configurações padrão podem invalidar uma comparação direta.