02 de setembro de 2026 · 3 fontes independentes
A técnica pode comprometer a capacidade de monitorar o raciocínio da IA, aumentando os riscos de comportamentos indesejados.
A preocupação é que a técnica dificulte a supervisão do modelo, permitindo comportamentos perigosos sem detecção.
A fala indica que a preocupação vai além do caso específico, envolvendo um possível padrão de mercado perigoso.
Se a OpenAI expandir a técnica, o modelo pode ficar completamente opaco, impossibilitando a supervisão humana.
É a primeira confirmação relatada do uso dessa técnica pela OpenAI, detalhada pela publicação The Information.
Confirmado por