Deepinfra
Una opción sólida cuando el modelo disponible produce resultados fiables en su conjunto de evaluación.
Funciona bien
- Puede evaluarse con los mismos prompts específicos de la tarea y los mismos criterios de puntuación utilizados para Together AI.
- Permite a quien ya usa Deepinfra evaluar la calidad sin modificar primero la aplicación.
- Puede alcanzar el umbral de calidad de la tarea aunque otro proveedor destaque en una prueba de referencia no relacionada.
Aspectos a considerar
- Un resultado favorable para un modelo no demuestra la calidad del resto del catálogo.
- Las diferencias en las versiones de los modelos o en los ajustes predeterminados pueden invalidar una comparación directa.