Descrição
Phi-4-reasoning-plus é um modelo avançado de raciocínio desenvolvido pela Microsoft Research. Ele é ajustado a partir do modelo Phi-4 usando aprendizado supervisionado em um conjunto de dados de rastros de cadeia de pensamento e aprendizado por reforço. O modelo é projetado para se destacar em tarefas de raciocínio, particularmente em matemática, ciência e programação. Ele utiliza uma arquitetura de Transformer denso apenas de decodificador com 14 bilhões de parâmetros e é otimizado para entradas de texto, especialmente em formato de chat. O treinamento do modelo envolveu 16 bilhões de tokens, com aproximadamente 8,3 bilhões de tokens únicos, ao longo de um período de 2,5 dias usando 32 GPUs H100-80G. O modelo gera respostas de texto com um bloco de cadeia de pensamento de raciocínio seguido por um bloco de sumarização, tornando-o adequado para tarefas que requerem raciocínio profundo e em múltiplas etapas ou contexto extenso.
Phi-4-reasoning-plus foi avaliado em vários benchmarks, incluindo AIME, GPQA-Diamond, OmniMath e LiveCodeBench, demonstrando um desempenho forte em tarefas intensivas de raciocínio. O modelo também é suportado por frameworks como Ollama, llama.cpp e qualquer framework compatível com Phi-4. Ele é lançado sob a licença MIT e é destinado ao uso em sistemas e aplicações de IA de propósito geral, particularmente em ambientes com restrições de memória/cálculo e cenários limitados por latência.
O modelo incorpora uma abordagem robusta de segurança pós-treinamento por meio de ajuste fino supervisionado, aderindo às diretrizes de segurança da Microsoft. Ele passou por extensas avaliações de segurança, incluindo simulações de conversas adversariais e avaliações pela equipe independente de IA Red Team da Microsoft. Apesar de suas capacidades, os desenvolvedores devem estar cientes das limitações do modelo, como potenciais preconceitos, imprecisões e a taxa elevada de defeitos em consultas críticas para eleições. Os desenvolvedores são incentivados a aplicar as melhores práticas de IA responsável e garantir a conformidade com as leis e regulamentos relevantes ao implantar o modelo.
Destaques de Modelo Phi-4-reasoning-plus
Modelo de raciocínio de ponta
Ajustado a partir do Phi-4
14 bilhões de parâmetros
Arquitetura de Transformer denso apenas de decodificador
Treinado em 16 bilhões de tokens
Suporta entradas em formato de chat
Gera blocos de cadeia de pensamento de raciocínio e sumarização
Abordagem robusta de segurança pós-treinamento
Primeiros passos com Modelo Phi-4-reasoning-plus
Acessar página: Visite a página do modelo Hugging Face
Carregar modelo: Baixe e carregue o modelo Phi-4-reasoning-plus
Configurar ambiente: Configure o ambiente com as dependências necessárias
Integrar: Use o modelo em sua aplicação
Ajustar: Ajuste o modelo para tarefas específicas, se necessário
Casos de uso de Modelo Phi-4-reasoning-plus
- Raciocínio avançado
- Assistência em programação
- Aceleração de pesquisa
- IA de propósito geral
- Ambientes com restrições de memória








