Categories: Notícias

OpenAI intensifica rivalidade com Anthropic ao lançar GPT-5.6 e plataforma ChatGPT Work

Share

A OpenAI revelou nesta terça-feira uma série de inovações significativas, incluindo as novas versões de seu modelo de linguagem, o GPT-5.6, e uma ferramenta de produtividade, o ChatGPT Work. Os lançamentos chegam ao mercado em um momento de acirrada competição com a Anthropic, principal concorrente no setor de inteligência artificial, e visam oferecer superioridade em termos de custo-benefício, velocidade e eficiência para os usuários.

Entre as novidades, destacam-se três novos modelos de IA: GPT-5.6 Sol, Terra e Luna. A expectativa em torno da versão 5.6 já era grande, especialmente após um adiamento ocorrido no mês passado, motivado por intervenções governamentais. Este anúncio ocorre em meio a debates recentes entre a Anthropic e a Casa Branca sobre seus modelos Fable 5 e Mythos 5, o que sublinha a crescente fiscalização regulatória sobre o desenvolvimento da inteligência artificial.

Além dos modelos avançados, a OpenAI apresentou o ChatGPT Work, uma solução criada para disputar diretamente com o Claude Cowork. Esta nova funcionalidade permite que a inteligência artificial interaja com o sistema operacional e o navegador do usuário, executando diversas tarefas de forma automatizada, o que representa um avanço considerável na integração da IA ao fluxo de trabalho diário.

Embora a capacidade de automação já fosse uma característica presente no aplicativo Codex da OpenAI, voltado para programação ética, a empresa optou por separar o assistente de trabalho ético da ferramenta de codificação. Essa estratégia de marca, aparentemente inspirada nas táticas da Anthropic, busca tornar o ChatGPT Work mais acessível e atraente para um público amplo, mesmo para aqueles sem conhecimento em programação, ampliando seu potencial de mercado.

Como a OpenAI busca superar os modelos da Anthropic

A OpenAI demonstra um foco estratégico na concorrência com a Anthropic. As recentes introduções de seus novos modelos são claramente direcionadas aos resultados de testes e à política de preços dos produtos da Anthropic, evidenciando uma batalha intensa pela liderança no mercado de inteligência artificial generativa.

O modelo Sol é a principal aposta da OpenAI, posicionado para competir diretamente com o Fable 5 da Anthropic. Sua capacidade de processamento e raciocínio é equiparável à do GPT-5.5, demonstrando um salto significativo em desempenho.

Já o Terra, com um poder computacional ligeiramente inferior ao Sol, foi concebido para ser o modelo padrão e mais utilizado dentro da série GPT-5.6, oferecendo um desempenho similar ao do GPT-5.5 em tarefas cotidianas.

Por sua vez, o modelo Luna, com menor capacidade se comparado ao Terra, atua como o equivalente à versão de resposta instantânea do GPT-5.5, priorizando a agilidade nas interações para um uso mais dinâmico.

Em testes de referência como o Agents’ Last Exam, que avalia o desempenho de IAs em fluxos de trabalho complexos e profissionais em 55 áreas, a OpenAI divulgou que o GPT-5.6 Sol atingiu 53,6 pontos, superando o Claude Fable 5 por uma margem de 13,1 pontos, indicando uma vantagem considerável.

No Índice de Inteligência Artificial Analítica, que mede a inteligência abrangente dos modelos, a OpenAI declarou que o Sol ficou a apenas um ponto do Fable 5, completando as tarefas em impressionantes 61% menos tempo, destacando sua eficiência operacional.

Em mais um comparativo, a OpenAI reportou que o GPT-5.6 Sol alcançou 80 pontos no Índice de Agentes de Codificação de Análise Artificial, ultrapassando o Fable 5 em 2,8 pontos, o que reforça sua robustez em tarefas de programação e análise de código.

A OpenAI salienta que o GPT-5.6, especialmente o modelo Sol, oferece maior eficiência e, consequentemente, um custo operacional reduzido em comparação com o Fable. A empresa indicou que, em nível de raciocínio médio, o Sol superou o Fable 5 em 11,4 pontos percentuais, com um custo estimado em aproximadamente quatro vezes menor, o que pode ser um diferencial competitivo para empresas.

A nova versão GPT-5.6 também se mostra mais rápida e eficaz em relação ao seu antecessor, o GPT-5.5. A Qodo, uma ferramenta de revisão de código baseada em inteligência artificial, utiliza esses modelos para fornecer um contexto aprofundado do código, com o objetivo de acelerar o desenvolvimento de softwares e aprimorar sua qualidade.

Itamar Friedman, cofundador e CEO da Qodo, afirmou que “o GPT-5.6 foi o modelo mais robusto que avaliamos em nossos testes de revisão de código ético. Em nossos benchmarks de PR internos e externos, ele superou o GPT-5.5 no F1, utilizando aproximadamente três vezes menos tokens por PR e apresentando uma latência mediana cerca de duas vezes menor”, evidenciando os ganhos práticos.

Em resposta às recentes preocupações governamentais sobre a segurança e o uso responsável de modelos de IA, a OpenAI garante que o GPT-5.6 incorpora mecanismos de proteção que integram segurança intrínseca ao modelo, verificações em tempo real, monitoramento contínuo e acesso ajustado por níveis de confiança e risco. A empresa declarou em comunicado que “o GPT-5.6 é lançado com nossas salvaguardas mais robustas até o momento”, buscando tranquilizar usuários e reguladores.

Novas funcionalidades do ChatGPT Work para otimizar a produtividade

Em destaque, o ChatGPT Work se apresenta como uma ferramenta de produtividade para computadores, desenvolvida pela OpenAI com base em agentes inteligentes. Similar ao Claude Cowork, a solução permite a criação de planilhas complexas, apresentações em PowerPoint e até mesmo o desenvolvimento de sites completos. Ele é capaz de gerenciar projetos de alta complexidade por longos períodos, dividindo-os em tarefas menores para otimizar o fluxo de trabalho e a execução.

Uma demonstração impressionante exibiu o ChatGPT Work operando de forma autônoma no aplicativo Notas da Apple de um usuário, reorganizando completamente suas anotações. Essa capacidade levanta discussões importantes sobre o grau de automação e a delegação de tarefas que os usuários estarão dispostos a confiar a ferramentas de inteligência artificial, além de suas implicações para a gestão e a privacidade de dados pessoais.

A demonstração do ChatGPT Work ressalta seu potencial robusto, mas também enfatiza a necessidade de considerar cuidadosamente o nível de confiança e de delegação que os usuários podem ou devem depositar em sistemas de inteligência artificial para a execução de tarefas complexas, especialmente aquelas que envolvem informações sensíveis.

Conforme a OpenAI, “a melhor maneira de aprender a usar o ChatGPT Work é atribuir-lhe uma tarefa que você já domine: analisar a variação do orçamento de fim de mês, transformar materiais de origem em um briefing de campanha”, sugerindo que a familiaridade com a tarefa original pode facilitar a adaptação do usuário à nova ferramenta e maximizar sua eficácia.