Na quinta-feira, OpenAI anunciado o lançamento do GPT-5.5, a atualização mais recente de seu modelo principal. É exatamente uma atualização tanto quanto o salto de 5,4 para 5,5 sugeriria.
A empresa chamou o modelo de “mais intuitivo de usar” e um “próximo passo em direção a uma nova maneira de realizar o trabalho em um computador”, o que parece o tipo de coisa que você diz quando não tem grandes melhorias para mostrar agora. Em uma postagem no blog, ele disse que o modelo funciona mais rápido do que as iterações anteriores e mostra “ganhos” em “codificação agentica, uso de computadores, trabalho de conhecimento e pesquisas científicas iniciais – áreas onde o progresso depende do raciocínio dentro do contexto e da ação ao longo do tempo”. Por enquanto, teremos que acreditar na palavra deles sobre isso.
No X, o CEO da OpenAI, Sam Altman, expressou seu entusiasmo pelo GPT-5.5, afirmando“Eu pessoalmente gosto disso.” Uau. Altman também elogiou a equipe por trás disso, dizendo: “Trabalho realmente excelente da equipe de inferência para servir este modelo de forma tão eficiente”, em referência ao desempenho supostamente melhorado do modelo. “Até certo ponto, temos que nos tornar uma empresa de inferência de IA agora”, disse ele. Altman também tem republicado elogios, incluindo um postagem do CEO da Magic Path, Pietro Schirano isso disse que o GPT-5.5 deu a ele “meu primeiro gostinho de AGI”.
Como sempre acontece quando as empresas promovem uma nova atualização de modelo, a OpenAI incluiu uma série de benchmarks que sugerem que seu resultado está melhor do que nunca. Ele observa que supera o Claude Opus 4.7 da rival Anthropic, o mais novo modelo disponível publicamente da empresa, em vários padrões de segurança cibernética e benchmarks de uso de computador que testam a capacidade de um agente de IA de operar de forma autônoma. No entanto, a empresa ainda está atrás da Anthropic nos testes de codificação. Deedy Das, sócio da Menlo Ventures disse O modelo da OpenAI não atinge o estado da arte quando se trata de capacidades de codificação.
E, claro, a Anthropic provavelmente argumentaria que Claude Opus 4.7 nem é o modelo que deveria ser o padrão. Quando a empresa abandonou esse modelo na semana passada, ela carregou basicamente todos os benchmarks com evidências de que seu Claude Mythos Preview, o modelo poderoso demais para ser tornado público ao qual está dando acesso limitado, destrói todas as alternativas, incluindo o Opus.
Independentemente disso, o GPT-5.5 parece uma melhoria incremental em relação ao GPT-5.4. E não está claro até que ponto os benchmarks são realmente úteis para avaliar essas ferramentas. Cada vez mais, empresas treinam para o testee quando são empurrados de maneiras inesperadas, eles ainda quebra. O quanto alguém fora da indústria realmente se preocupa com esses resultados de testes também parece questionável.
Mas você definitivamente não pode dizer que o OpenAI não está iterando. Na semana passada, a empresa anunciou um novo modelo de geração de imagem, “agentes de espaço de trabalho” que podem concluir tarefas de forma autônomaum modelo para detectar e redigir informações de identificação pessoal no texto, e lançou uma atualização para seu agente de codificação Codex. O exército de Sam Altman está definitivamente lançando atualizações, mesmo que todas comecem a se misturar.











