O AGENTICO
Voltar
MXFP4
produto · 2 menções
Menções

O QAH foi aplicado a um modelo GPT-OSS de 120B parâmetros, comprimido para 60B com quantização MXFP4 de 4 bits.
Descreve a aplicação prática do método e as especificações técnicas do modelo.

Os pesquisadores afirmam que, em um pipeline de cura baseado em destilação, o passo de quantização não é um custo a ser minimizado, mas uma oportunidade adicional para supervisão do professor, produzindo um modelo ao mesmo tempo mais barato, mais leve e pelo menos tão preciso quanto sua versão em precisão total.
Essa é uma mudança conceitual importante: trata a quantização como benefício no treinamento, não como perda a corrigir.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.