Pular para o conteúdo
GenAI BR
Cinco · edição semanal · terça, 7h
Cinco 1terça-feira, 8 de setembro de 2026rascunho

A tesoura: a fronteiraencareceu e o modeloaberto virou centavo

Abertura

Em 2023, o modelo mais capaz do mundo cobrava US$ 60 por milhão de tokens de saída. Em abril de 2025 cobrava US$ 8. Na quinta-feira passada, o GPT-6 Astra saiu a US$ 50 — o mesmo preço do Claude Fable 5.1, e duas vezes e meia o do modelo que a OpenAI lançou em junho. No mesmo intervalo de duas semanas, a Z.ai colocou um modelo de 320 bilhões de parâmetros, sob licença MIT, servido segundo a empresa só em chips chineses, a US$ 0,50. A distância entre as duas pontas é de cem vezes. É isso que chamamos de tesoura: as lâminas se afastam, e o que está entre elas é o mercado inteiro de quem constrói com IA.

A tese desta edição é simples de enunciar e difícil de aceitar: o preço por token deixou de ser a variável que decide entre fechado e aberto. Para trabalho agentivo — código, terminal, operação de sistemas — os modelos abertos permissivos chegaram a uma faixa de capacidade em que a decisão de compra passa a depender de outras três coisas: se o modelo funciona no seu domínio (e os benchmarks que todo lançamento cita não dizem), se dá para confiar no que ele diz que está pensando (o próprio relatório do GPT-6 diz que cada vez menos), e onde ele roda (o que, no Brasil, virou uma licitação de R$ 959 milhões com prazo em 8 de outubro).

Os cinco movimentos abaixo seguem essa ordem: o peso dos pesos abertos, o preço, o benchmark que não separa mais, o raciocínio que não se deixa ler, e os sete mil petaflops de Macaíba. Cada um tem um gráfico ou um trecho de código executado; os números estão nas tabelas; as fontes, numeradas no fim. Se você só tem tempo para um: o segundo.

Lido e escrito por João Campista · 23 min de leitura

Os cinco movimentos

  1. I
    Modelos abertos

    O peso dos pesos

    A Tencent publicou um mixture-of-experts de 770 bilhões de parâmetros sob Apache 2.0. Custa para rodar como um modelo de 49 bilhões — e precisa de memória para os 770. “Aberto”, nesse tamanho, é uma palavra com dono.

    1 figura · 1 código
  2. II
    Infra e custo

    Quinze centavos

    A fronteira fechada voltou a custar o que custava em 2023. O modelo aberto que a acompanha de perto custa um centésimo disso. O preço de lista virou um sinal de posicionamento — e parou de ser uma medida de custo.

    2 figuras · 1 código · 1 tabela
  3. III
    Avaliação

    O número que não separa mais

    O SWE-bench Verified foi de 33% a 96% em dois anos e parou de distinguir modelos. Um grupo de Fudan reuniu 119 bugs reais de software científico: o melhor agente resolve menos da metade — e, com essa amostra, os cinco primeiros são estatisticamente o mesmo.

    2 figuras · 1 código
  4. IV
    Produto · Interpretabilidade

    Ler o raciocínio

    O GPT-6 Astra resetou o teto de quase todos os benchmarks que a OpenAI escolheu mostrar. O system card, lido até o fim, diz outra coisa: as cadeias de pensamento ficaram mais curtas, e a empresa terá “confiança significativamente reduzida” para detectar alguns comportamentos desalinhados.

    1 figura · 1 código
  5. V
    Regulação e Brasil

    Sete mil petaflops

    Depois de dois anos e três adiamentos, o supercomputador do Plano Brasileiro de IA virou um edital: R$ 959 milhões, 7.200 PFLOPS em FP16, Macaíba (RN), propostas até 8 de outubro. É o primeiro passo com número, prazo e documento. Também é menor, em dinheiro e em megawatts, do que o plano prometia.

    1 figura · 1 código · 1 tabela

Receba o próximo Cinco

Terça, 7h, no seu e-mail. Cinco itens, com fonte. Sem newsletter diária, sem promoção, e o descadastro é um clique.

Só o e-mail. Nada de rastreador de terceiros nesta página. Política de privacidade.

O que estamos construindo

Acervo por tema

Acervo
  1. Modelos abertos5

    Pesos abertos, licenças, relatórios técnicos e o que dá para rodar por conta própria.

  2. Agentes7

    Sistemas que planejam, usam ferramentas e agem — e como saber quando funcionam.

  3. Avaliação7

    Benchmarks, contaminação, leaderboards e a distância entre a nota e o uso real.

  4. Interpretabilidade3

    O que acontece dentro do modelo: features, circuitos, fidelidade da cadeia de pensamento.

  5. Infra e custo5

    Inferência, GPUs, preço por token, e o que muda quando o custo cai dez vezes.

  6. Multimodal2

    Imagem, áudio, vídeo e texto no mesmo modelo — e o que isso custa.

  7. Regulação e Brasil3

    PL 2338, ANPD, PBIA, mercado de trabalho e o que acontece com IA daqui.

  8. Produto4

    Lançamentos, preços, APIs e decisões de produto que mudam o que dá para construir.

Quem lê por você

Hoje, uma pessoa: João Campista, em São Paulo. Leio umas duzentas coisas por semana e escolho cinco. A triagem é assistida por IA; a leitura, o julgamento e o texto são meus.