Descripción
Revalvo es un banco de trabajo de primera local diseñado para evaluar modelos de lenguaje grandes (LLMs) ejecutando prompts en múltiples modelos simultáneamente. Proporciona un entorno integral donde los usuarios pueden escribir, ejecutar, versionar y evaluar prompts antes de que lleguen a producción. A diferencia de las interfaces de chat tradicionales, Revalvo ofrece control total sobre los prompts, modelos y variables, asegurando transparencia y trazabilidad con puntuaciones, diferencias y el historial de versiones.
La plataforma no es un SaaS típico; no requiere la creación de una cuenta y todos los datos permanecen en el navegador del usuario, garantizando privacidad y seguridad. Los usuarios pueden conectar sus proveedores utilizando claves, OAuth o entornos locales, y crear espacios de trabajo separados para cada proveedor. La función de parque de pruebas permite a los usuarios escribir una vez y ejecutar en todas partes, con modelos respondiendo al mismo prompt en paralelo, proporcionando métricas como latencia, tokens y costo por respuesta.
El sistema de control de versiones de Revalvo trata los prompts como código, con instantáneas inmutables, historial de versiones al estilo Git y la capacidad de retroceder a cualquier versión anterior. Los usuarios pueden exportar versiones como fragmentos de API o prompts de agente y duplicar prompts a través de espacios de trabajo para nuevas evaluaciones.
La plataforma admite pruebas a gran escala con conjuntos de datos, ofreciendo 40 evaluadores ejecutables por lotes para estructura, juicio de IA, rendimiento y seguridad. Los informes generados a partir de ejecuciones por lotes incluyen tasas de aprobación, latencia y costo por modelo, proporcionando un recibo detallado de la preparación para el envío.
Revalvo está optimizado para la eficiencia, con configuraciones predeterminadas cuidadosas y un tiempo de configuración mínimo. Equilibra la velocidad de los parques de pruebas de chat con el rigor de las plataformas de evaluación completas, lo que lo hace adecuado tanto para usuarios primerizos como para ingenieros de prompts experimentados.
Características principales de Revalvo
Evaluación de LLM de primera local
Puntuación en tiempo real y control de versiones
No se requiere cuenta
Transparencia total con puntuaciones y diferencias
Conexión a través de claves, OAuth o entornos locales
Evaluación de respuestas de modelos en paralelo
Historial de versiones al estilo Git
Pruebas por lotes con 40 evaluadores
¿Cómo usar Revalvo?
Configurar: Conecta tu proveedor utilizando claves o OAuth
Usar: Ejecuta prompts en múltiples modelos en paralelo
Optimizar: Guarda y versiona tus prompts con historial al estilo Git
Probar: Ejecuta pruebas por lotes con conjuntos de datos y evaluadores
Casos de uso de Revalvo
- Evaluación de Prompts
- Control de Versiones
- Pruebas por Lotes
- Comparación de Modelos
- Privacidad de Datos





