Descripción
Phi-4-reasoning-plus es un modelo de razonamiento avanzado desarrollado por Microsoft Research. Está ajustado a partir del modelo Phi-4 utilizando aprendizaje supervisado en un conjunto de datos de trazas de cadena de pensamiento y aprendizaje por refuerzo. El modelo está diseñado para sobresalir en tareas de razonamiento, particularmente en matemáticas, ciencias y programación. Utiliza una arquitectura de Transformer densa solo de decodificador con 14 mil millones de parámetros y está optimizado para entradas de texto, especialmente en formato de chat. El entrenamiento del modelo involucró 16 mil millones de tokens, con aproximadamente 8.3 mil millones de tokens únicos, durante un período de 2.5 días utilizando 32 GPUs H100-80G. El modelo genera respuestas de texto con un bloque de cadena de pensamiento de razonamiento seguido de un bloque de resumen, lo que lo hace adecuado para tareas que requieren razonamiento profundo y en múltiples pasos o un contexto extenso.
Phi-4-reasoning-plus ha sido evaluado en varios puntos de referencia, incluidos AIME, GPQA-Diamond, OmniMath y LiveCodeBench, demostrando un rendimiento sólido en tareas intensivas en razonamiento. El modelo también es compatible con marcos como Ollama, llama.cpp y cualquier marco compatible con Phi-4. Se lanza bajo la licencia MIT y está destinado para su uso en sistemas y aplicaciones de IA de propósito general, particularmente en entornos con limitaciones de memoria/cálculo y escenarios con restricciones de latencia.
El modelo incorpora un enfoque robusto de seguridad posterior al entrenamiento a través de un ajuste fino supervisado, cumpliendo con las pautas de seguridad de Microsoft. Ha pasado por extensas evaluaciones de seguridad, incluidas simulaciones de conversaciones adversariales y evaluaciones por parte del equipo independiente de IA Red Team de Microsoft. A pesar de sus capacidades, los desarrolladores deben ser conscientes de las limitaciones del modelo, como sesgos potenciales, inexactitudes y la elevada tasa de defectos en consultas críticas para elecciones. Se alienta a los desarrolladores a aplicar las mejores prácticas de IA responsable y garantizar el cumplimiento de las leyes y regulaciones pertinentes al implementar el modelo.
Aspectos destacados de Modelo Phi-4-reasoning-plus
Modelo de razonamiento de vanguardia
Ajustado a partir de Phi-4
14 mil millones de parámetros
Arquitectura de Transformer densa solo de decodificador
Entrenado en 16 mil millones de tokens
Soporta entradas en formato de chat
Genera bloques de cadena de pensamiento de razonamiento y resumen
Enfoque robusto de seguridad posterior al entrenamiento
Primeros pasos con Modelo Phi-4-reasoning-plus
Acceder a la página: Visita la página del modelo en Hugging Face
Cargar modelo: Descarga y carga el modelo Phi-4-reasoning-plus
Configurar entorno: Configura el entorno con las dependencias requeridas
Integrar: Usa el modelo en tu aplicación
Ajustar: Ajusta el modelo para tareas específicas si es necesario
Casos de uso de Modelo Phi-4-reasoning-plus
- Razonamiento avanzado
- Asistencia en programación
- Aceleración de la investigación
- IA de propósito general
- Entornos con limitaciones de memoria








