A OpenAI lançou nesta semana dois novos modelos de inteligência artificial, batizados de Sol e Luna, que ampliam a família GPT-6. Segundo a empresa, os modelos custam metade do preço da geração 5.6 quando usados via API, interface que permite a outros sistemas se conectarem à tecnologia.
O que mudou nos novos modelos
O Sol foi desenvolvido para tarefas complexas de programação. De acordo com a OpenAI, ele reduz pela metade o índice de erros em comparação com a versão anterior da linha. Já o Luna é voltado para tarefas administrativas e respostas rápidas, priorizando velocidade em consultas do dia a dia.
A redução de custo foi atribuída a otimizações de inferência, processo pelo qual o modelo gera respostas a partir do que aprendeu, e a técnicas de caching, que armazenam informações usadas com frequência para acelerar o processamento e reduzir gastos computacionais.
Por que isso importa
Preços mais baixos por milhão de tokens, unidade que mede a quantidade de texto processada pelos modelos, tendem a baratear produtos e serviços que dependem de IA generativa, como assistentes virtuais, ferramentas de atendimento e softwares de produtividade.
A divisão entre um modelo especializado em código e outro voltado a tarefas simples também reflete uma tendência do setor: em vez de um único modelo genérico, empresas de IA vêm oferecendo opções segmentadas para equilibrar custo e desempenho conforme o uso.
O que muda para desenvolvedores e empresas
Para desenvolvedores, a chegada do Sol pode significar menos revisão manual de código gerado por IA, já que a taxa de erros foi reduzida. Para empresas que usam IA em grande volume, como suporte ao cliente ou automação de tarefas administrativas, o Luna surge como alternativa mais econômica para operações que não exigem tanta complexidade.
A expectativa do mercado é que a redução de preços pressione concorrentes a rever suas próprias tabelas de cobrança, movimento que já vem ocorrendo entre as principais empresas de inteligência artificial generativa.
O que observar daqui para frente
Ainda não há detalhes completos sobre limites de uso, disponibilidade em outras interfaces além da API ou cronograma de expansão para outros mercados. A confirmação de ganhos reais de desempenho e custo deve vir com o uso mais amplo dos modelos por desenvolvedores e empresas nas próximas semanas.
Mais detalhes podem ser conferidos na reportagem original do TechCrunch.


Deixe um comentário