Перейти к основному содержимому
ToolPotion

Модель Phi-4-reasoning-plus

Phi-4-reasoning-plus — это современная модель рассуждений, разработанная Microsoft Research. Она дообучена на основе Phi-4 с использованием контролируемого обучения и обучения с подкреплением, предназначена для сложных задач рассуждений в математике, науке и программировании.

Открыть модель
Поделиться

Описание

Phi-4-reasoning-plus — это продвинутая модель рассуждений, разработанная Microsoft Research. Она дообучена на основе модели Phi-4 с использованием контролируемого обучения на наборе данных цепочек рассуждений и обучения с подкреплением. Модель предназначена для достижения высоких результатов в задачах рассуждений, особенно в математике, науке и программировании. Она использует плотную архитектуру Transformer только для декодирования с 14 миллиардами параметров и оптимизирована для текстовых входов, особенно в формате чата. Обучение модели включало 16 миллиардов токенов, с примерно 8,3 миллиарда уникальных токенов, за период 2,5 дня с использованием 32 GPU H100-80G. Модель генерирует текстовые ответы с блоком цепочки рассуждений, за которым следует блок обобщения, что делает её подходящей для задач, требующих глубоких многоступенчатых рассуждений или обширного контекста.

Phi-4-reasoning-plus была оценена по различным бенчмаркам, включая AIME, GPQA-Diamond, OmniMath и LiveCodeBench, демонстрируя высокую производительность в задачах, требующих рассуждений. Модель также поддерживается такими фреймворками, как Ollama, llama.cpp и любым совместимым с Phi-4 фреймворком. Она выпущена под лицензией MIT и предназначена для использования в системах и приложениях общего назначения, особенно в условиях ограниченной памяти/вычислительных ресурсов и сценариях, чувствительных к задержкам.

Модель включает в себя надежный подход к безопасности после обучения через контролируемое дообучение, соблюдая рекомендации по безопасности Microsoft. Она прошла обширные оценки безопасности, включая симуляции противостоящих разговоров и оценки независимой команды Red Team по ИИ в Microsoft. Несмотря на свои возможности, разработчики должны быть осведомлены о ограничениях модели, таких как потенциальные предвзятости, неточности и повышенная частота дефектов в критически важных запросах на выборах. Разработчики призываются применять лучшие практики ответственного ИИ и обеспечивать соблюдение соответствующих законов и норм при развертывании модели.

Главное о Модель Phi-4-reasoning-plus

  • Современная модель рассуждений

  • Дообучена на основе Phi-4

  • 14 миллиардов параметров

  • Плотная архитектура Transformer только для декодирования

  • Обучена на 16 миллиардах токенов

  • Поддерживает входные данные в формате чата

  • Генерирует блоки цепочки рассуждений и обобщения

  • Надежный подход к безопасности после обучения

Начало работы с Модель Phi-4-reasoning-plus

  1. Доступ к странице: Посетите страницу модели Hugging Face

  2. Загрузите модель: Скачайте и загрузите модель Phi-4-reasoning-plus

  3. Настройте окружение: Настройте окружение с необходимыми зависимостями

  4. Интегрируйте: Используйте модель в вашем приложении

  5. Дообучите: При необходимости настройте модель для конкретных задач

Варианты использования Модель Phi-4-reasoning-plus

  • Продвинутое рассуждение
  • Помощь в программировании
  • Ускорение исследований
  • Общий ИИ
  • Ограниченные по памяти среды

Часто задаваемые вопросы Модель Phi-4-reasoning-plus

From Microsoft

a model in Языковая модель Phi-2.

Отзывы о Модель Phi-4-reasoning-plus

Загрузка...

Популярные ИИ-инструменты, похожие на Модель Phi-4-reasoning-plus

Phi-4-reasoning-vision-15B — это мультимодальная модель ИИ, разработанная Microsoft, предназначенная для задач, требующих понимания языка и визуального восприятия, а также…

РекомендованоИИ-модели и LLM

DeepSeek-R1 — это продвинутая модель AI размышления, разработанная для повышения возможностей решения проблем с помощью обучения с подкреплением. Она нацелена на демократизацию…

РекомендованоИИ-модели и LLM

SmolLM3 — это языковая модель с 3 миллиардами параметров, разработанная для расширения возможностей малых моделей. Она поддерживает двойное режимное рассуждение, шесть языков и…

ИИ-модели и LLM

Falcon-H1R-7B — это специализированная модель ИИ, предназначенная для повышения производительности в задачах математики, программирования и логики. Разработанная Институтом…

РекомендованоИИ-модели и LLM

Mistral Small 4 — это универсальная AI модель, которая объединяет возможности рассуждения, программирования и мультимодальности в одной платформе. Она позволяет пользователям…

РекомендованоИИ-модели и LLM

Phi-2 — языковая модель с 2,7 миллиарда параметров от Microsoft Research. Она демонстрирует выдающиеся способности к рассуждению и пониманию языка, достигая наилучших результатов…

ИИ-модели и LLM

DeepSeek-V3.2 — это продвинутая модель ИИ, разработанная для эффективного рассуждения и агентских задач. Она включает в себя разреженное внимание DeepSeek, масштабируемое обучение…

ИИ-модели и LLM

AI-модели

DeepSeek R1 Online — это модель ИИ с открытым исходным кодом для продвинутого логического вывода, превосходящая o1 от OpenAI. Она использует архитектуру Mixture of Experts с 37…

ИИ-модели и LLM