A queda da última barreira
Como o GPT 5.6 Luna e o DeepSeek V4 Flash removeram o empecilho final.
Perguntaram-me recentemente como eu via a adoção da IA nas empresas, tanto nos Estados Unidos – onde trabalho como diretor de um time de engenharia – quanto no Brasil – onde presto consultorias e recebo inúmeros relatos todos os dias.
Disse que após Novembro de 2025 muita coisa mudou com o lançamento do Opus 4.5, Gemini 3 e GPT 5.1, do que falei extensamente nesse espaço. Ali, figuras importantes da comunidade de tecnologia deram-se por vencidas, e recentemente o lendário Linus Torvalds disse aos que reclamavam do uso de IA na codebase do kernel do Linux que criassem seu próprio fork – ou parassem de encher o saco.
Ainda assim, aqui no Brasil uma última barreira ainda se sustentava: custo. Se para disponibilizar $200-$500 em assinaturas de IA (ou muito mais em créditos de API) para cada integrante do seu time pode ser considerado um investimento para uma empresa americana, no Brasil isso ainda representa um preço alto. Considerando-se um funcionário que ganha R$ 10.000, $500 em assinaturas ou créditos para uso de IA representam cerca de 30% do salário bruto, um número significativo o suficiente para tornar essa decisão não tão óbvia.
Mas ouso dizer que mesmo essa última linha de defesa foi derrubada. Isso porque nos últimos dias a OpenAI reduziu o preço do GPT Luna em 80%, enquanto o novo DeepSeek V4 Flash apresentou um ganho sensível de qualidade mantendo o mesmo preço. Como referência, o GPT 5.6 Luna no reasoning max é superior ao GPT 5.5 medium – a recomendação padrão da OpenAI há 3 semanas atrás – no benchmark do Artificial Analysis, e bate o Opus 4.8 e o Sonnet 5 com folga no DeepSWE. A diferença? Entre 20-25x mais barato que os flagships das versões anteriores.
Já o DeepSeek V4 Flash é ainda mais impressionante pois apresenta um desempenho igual ou superior ao GLM 5.2 – modelo que muitos consideraram superior ao Opus 4.8 na ocasião do lançamento – porém a um custo próximo do risível. Um desenvolvedor pode assinar o OpenCode Go por $5 no 1º mês e ter acesso essencialmente infinito a esse modelo chinês, que além de tudo é open weight e 3x menor que o GLM, ou seja, factível de ser servido localmente.
Olhando a parte prática, embora nos meus testes o Luna max tenha apresentado um bom resultado, ele é mais lento que o normal – consequência incômoda do reasoning alto. Já havia dito que considerava esse um bom modelo para uso como assistente pessoal, como o Hermes, dentro de uma assinatura da OpenAI. Reduzido em 80%, é difícil achar deal melhor, principalmente porque esse tipo de uso não requer o máximo de inteligência.
Nesse ponto, o DeepSeek V4 Flash é imbatível, pois mesmo na assinatura low cost do OpenCode Go ele é servido com alto TPS, o que é fundamental para um modelo que se espera um número maior de iterações. Sim, ele é menos inteligente e você terá que controlá-lo na rédea curta, mas a $0,28/M output tokens, quem se importa?
É bom dizer que a comparação entre esses dois modelos não é tão justa já que o Luna é multimodal – aceita imagens e arquivos como input – tornando-o mais interessante para trabalhos onde é necessário passar uma referência, como um típico workflow de frontend. Por essa razão, a comparação mais adequada de fato é o Flash com o GLM 5.2, que também é text-only.
Ainda assim, um desenvolvedor pode tranquilamente construir um setup de baixo custo com Luna max como planejador e DeepSeek V4 Flash como executor e ainda pagar menos de $20/mês. Isso sem falar que em breve veremos o novo DeepSeek V4 Pro, que certamente chegará para disputar com o Luna o posto de melhor custo-benefício por inteligência.
Portanto, se ainda existia um argumento contrário à adoção da IA no dia a dia das empresas brasileiras, hoje não existe mais. Em agosto de 2026 é seguro dizer que IAs baratas não equivalem a IAs de baixa qualidade, muito embora os modelos mais caros ainda ofereçam outras vantagens, a saber: inteligência superior para problemas complexos, execução de tarefas de horizonte longo, cibersegurança, etc.
Por fim, considere que o modelo principal da OpenAI em março desse ano era o GPT 5.4, e que passados 4 meses a mesma empresa oferece um modelo superior por 8% do preço. Em breve, teremos a capacidade de um Fable por preços similares. Eventualmente nem precisaremos pagar por uso, já que nossos próprios computadores conseguirão rodar um modelo capaz de forma local. A barreira do preço já ruiu, e a única coisa que importa é o que você vai escolher construir.



