Phi-4-reasoning-plus — это усовершенствованная модель от Microsoft с 14 млрд параметров, дообученная на основе Phi-4 с помощью обучения с подкреплением для повышения точности в задачах по математике, естественным наукам и программированию. Она использует ту же плотную архитектуру трансформера только с декодером (decoder-only), что и Phi-4, но генерирует более длинные и содержательные ответы, структурированные в виде пошаговой трассировки рассуждений и итогового вывода.
Модель показывает лучшие результаты по сравнению с Phi-4-reasoning в бенчмарках AIME, OmniMath и HumanEvalPlus, однако её ответы обычно примерно на 50 % длиннее, что увеличивает время отклика. Предназначенная для англоязычных приложений, она оптимальна для рабочих процессов со структурированными рассуждениями, где качество ответа важнее скорости.