Os tokens são os pedaços de texto que uma IA usa para ler, processar e gerar linguagem. A cada interação com um chatbot de IA, são consumidos tokens correspondentes ao texto enviado pelo usuário e à resposta gerada pelo sistema.
A OpenAI atribuiu os cortes a ganhos de eficiência obtidos durante o desenvolvimento interno do GPT-5.6. A empresa disse que melhorias, incluindo o uso do modelo para otimizar software de produção e aprimorar a chamada “decodificação especulativa”, reduziram em 20% os custos de atendimento ponta a ponta e aumentaram em mais de 15% a eficiência de geração de tokens.
A companhia também citou avanços no gerenciamento de contexto no GPT-5.6 Sol. Segundo a OpenAI, isso elevou a pontuação do modelo no benchmark ARC-AGI-3 de 13,3% para 38,3%, usando seis vezes menos tokens de saída.
Em comunicado, a OpenAI defendeu que preços menores ampliam o uso de IA. “Quando o custo de uma inteligência útil cai, mais trabalho passa a valer a pena”, afirmou a empresa.
Pressão por custos e disputa no mercado
A redução ocorre em um momento de cautela de empresas com gastos altos em inteligência artificial. O Wall Street Journal afirmou que clientes corporativos estão mais desconfiados de despesas elevadas sem uma visão clara de retorno.
