A Batalha do Meio-Termo da OpenAI
As grandes empresas que continuamente redefinem a fronteira da inteligência artificial começaram a "esconder coisas".
A Anthropic lançou o Fable 5 no início de junho, e um mês depois a OpenAI lançou a série GPT-5.6; no entanto, com as questões de segurança a atraírem cada vez mais atenção e quase dois meses se passando, nenhuma das duas tomou novas medidas em relação a modelos de fronteira.
Enquanto a Anthropic, que detém a vantagem dos modelos mais avançados, parece estar à vontade, o mesmo não se pode dizer da OpenAI, que ocupa a posição de perseguidora tanto em receita quanto nos benchmarks de modelos.
Qual é a situação atual dentro da OpenAI?
Na mais recente reportagem de capa da revista TIME, "Inside OpenAI’s Reboot" (O Interior da Reinicialização da OpenAI), o repórter Alex Heath passou duas semanas na sede da OpenAI, entrevistando mais de 20 executivos da empresa, funcionários, investidores, clientes e concorrentes, além de conversar com Sam Altman por mais de duas horas, trazendo-nos informações em primeira mão —
Vendo a Anthropic roubar a iniciativa no mercado de desenvolvedores e empresas com o Claude Code, e o Google Gemini ultrapassar a marca de 1 bilhão de usuários mensais, a OpenAI da reportagem já não é mais a líder absoluta que definia o ritmo da corrida de IA dois anos atrás.
Altman admitiu de forma bastante direta na entrevista:
Como empresa, obviamente cometemos alguns erros. Seja na direção do produto ou na pesquisa de pré-treinamento, estamos atrasados em relação a onde queríamos estar. Assim, a OpenAI finalmente se decidiu e iniciou uma "reinicialização" drástica. Neste longo artigo, os principais pontos de vista do pessoal da OpenAI podem ser resumidos da seguinte forma:
A OpenAI admite ter perdido velocidade nos produtos.** O crescimento explosivo do ChatGPT fez com que a empresa negligenciasse o mercado de programação e empresas. Os modelos lideravam nas classificações, mas não se "transformaram" em produtos reais suficientemente bons.
- **O Codex está substituindo o ChatGPT como o novo eixo principal de produtos da empresa.** A OpenAI já reduziu projetos como Sora, a parceria com a Disney e o navegador independente Atlas, concentrando poder de computação e equipes no Codex, e integrando suas capacidades de Agente no ChatGPT Work.
- **O objetivo do próximo modelo, Astra, não é apenas responder a perguntas, mas trabalhar continuamente e criar novos conhecimentos.** A OpenAI demonstrou 16 Agentes colaborando para resolver problemas de matemática de nível de pesquisa, operando em alta velocidade entre softwares, e uma capacidade de pesquisa automatizada que pode concluir o trabalho de uma semana de um pesquisador de IA júnior.
- **Um incidente de "fuga" (jailbreak) de Agente forçou a OpenAI a pausar o treinamento de modelos mais fortes.** A empresa admitiu que já possuía ferramentas de alerta para monitorar a cadeia de pensamento do modelo, mas não as ativou por subestimar a capacidade do modelo. O lançamento do Astra também terá que esperar a aprovação de novas medidas de segurança.
- **A OpenAI quer fazer muito mais do que uma simples caixa de diálogo de chat.** Chips, data centers, hardware portátil, robôs humanoides, interfaces cérebro-computador e até a venda de poder de computação para terceiros foram todos inseridos no plano maior da "AGI pessoal".
OpenAI perde na força do produto
No último ano, a Anthropic ultrapassou a OpenAI em avaliação e receita anualizada pela primeira vez.
A TIME, citando dados, informou que a receita anualizada da Anthropic já ultrapassou 65 bilhões de dólares, e a da OpenAI é de cerca de 40 bilhões de dólares; ambas as empresas estão se preparando para abrir o capital, mas a Anthropic tem grandes chances de chegar lá primeiro.
Imagem|XDA Developers
A chave para a ultrapassagem da Anthropic foi o Claude Code, que quase definiu a forma do produto "Agente de programação" no início do ano.
Isso não significa que a capacidade do modelo da OpenAI seja inferior à da Anthropic. Embora suas habilidades de texto tenham recebido muitas críticas, segundo Greg Brockman, pelo menos no campo da programação, os resultados de Benchmark dos modelos da OpenAI "sempre lideraram".
O problema é que, no passado, a empresa se importava mais com engenharia do que com o produto, preocupando-se apenas se o modelo conseguia resolver problemas em ambientes de laboratório, mas ignorando os cenários de uso reais dos usuários desenvolvedores — se conseguia retomar tarefas interrompidas, se conseguia integrar um grande número de arquivos e se os detalhes da interação eram bons.
Esses são os fatores-chave que determinam qual ferramenta os usuários comuns escolherão.
Em outras palavras, a OpenAI não perdeu na capacidade de seus modelos de fronteira, mas sim na velocidade de transformar a capacidade do modelo em produtos, não conseguindo acompanhar os outros.
Claro, a OpenAI em si foi muito ativa no desenvolvimento de produtos. O sucesso do ChatGPT fez com que a OpenAI ficasse obcecada em criar produtos "divertidos", como o aplicativo de geração de vídeo Sora e o navegador independente Atlas, mas esses produtos acabaram desviando os recursos que a empresa usaria para atacar problemas difíceis.
Sam Altman admitiu na entrevista que a OpenAI se espalhou "muito finamente".
Agora, o cofundador e presidente da OpenAI, Greg Brockman, mais "econômico", assumiu a maior parte dos negócios internos da empresa, de receita e produtos a mercado. A OpenAI começou a cortar projetos paralelos, direcionando a escassa capacidade de computação para o Codex, que tem o crescimento mais rápido.
O ChatGPT ainda tem o maior número de usuários, mas não é mais o principal ponto de crescimento da OpenAI. Altman até parou de usar o ChatGPT por um mês, usando apenas o Codex.
Naturalmente, o Codex começou a ser mesclado ao ChatGPT, e o produto apresentado externamente é o ChatGPT Work — agora os usuários não precisam mais julgar...