Описание
Phi-4-reasoning-plus — это продвинутая модель рассуждений, разработанная Microsoft Research. Она дообучена на основе модели Phi-4 с использованием контролируемого обучения на наборе данных цепочек рассуждений и обучения с подкреплением. Модель предназначена для достижения высоких результатов в задачах рассуждений, особенно в математике, науке и программировании. Она использует плотную архитектуру Transformer только для декодирования с 14 миллиардами параметров и оптимизирована для текстовых входов, особенно в формате чата. Обучение модели включало 16 миллиардов токенов, с примерно 8,3 миллиарда уникальных токенов, за период 2,5 дня с использованием 32 GPU H100-80G. Модель генерирует текстовые ответы с блоком цепочки рассуждений, за которым следует блок обобщения, что делает её подходящей для задач, требующих глубоких многоступенчатых рассуждений или обширного контекста.
Phi-4-reasoning-plus была оценена по различным бенчмаркам, включая AIME, GPQA-Diamond, OmniMath и LiveCodeBench, демонстрируя высокую производительность в задачах, требующих рассуждений. Модель также поддерживается такими фреймворками, как Ollama, llama.cpp и любым совместимым с Phi-4 фреймворком. Она выпущена под лицензией MIT и предназначена для использования в системах и приложениях общего назначения, особенно в условиях ограниченной памяти/вычислительных ресурсов и сценариях, чувствительных к задержкам.
Модель включает в себя надежный подход к безопасности после обучения через контролируемое дообучение, соблюдая рекомендации по безопасности Microsoft. Она прошла обширные оценки безопасности, включая симуляции противостоящих разговоров и оценки независимой команды Red Team по ИИ в Microsoft. Несмотря на свои возможности, разработчики должны быть осведомлены о ограничениях модели, таких как потенциальные предвзятости, неточности и повышенная частота дефектов в критически важных запросах на выборах. Разработчики призываются применять лучшие практики ответственного ИИ и обеспечивать соблюдение соответствующих законов и норм при развертывании модели.
Главное о Модель Phi-4-reasoning-plus
Современная модель рассуждений
Дообучена на основе Phi-4
14 миллиардов параметров
Плотная архитектура Transformer только для декодирования
Обучена на 16 миллиардах токенов
Поддерживает входные данные в формате чата
Генерирует блоки цепочки рассуждений и обобщения
Надежный подход к безопасности после обучения
Начало работы с Модель Phi-4-reasoning-plus
Доступ к странице: Посетите страницу модели Hugging Face
Загрузите модель: Скачайте и загрузите модель Phi-4-reasoning-plus
Настройте окружение: Настройте окружение с необходимыми зависимостями
Интегрируйте: Используйте модель в вашем приложении
Дообучите: При необходимости настройте модель для конкретных задач
Варианты использования Модель Phi-4-reasoning-plus
- Продвинутое рассуждение
- Помощь в программировании
- Ускорение исследований
- Общий ИИ
- Ограниченные по памяти среды








