Microsoft — small model treinado em dados sintéticos curados, performance acima do peso em raciocínio.
Hipótese interessante: dados sintéticos high-quality > volume de dados. Phi-4 supera modelos open-weights 4-5× maiores em raciocínio. Risco: treinamento sintético pode quebrar em domínios fora da distribuição curada. Ecossistema ainda menor que Llama/Qwen. Vale entender se a tese se sustenta no Phi-5.