A OpenAI lançou seu mais recente modelo de inteligência artificial, que afirma ser capaz de compreender imagens enviadas, como quadros brancos, esboços e diagramas, mas são de baixa qualidade.A empresa chama o O3 de seu modelo mais avançado e lançou um modelo menor, o O4-mini.juntamente comGoogleA OpenAI está correndo para permanecer no topo do campo da inteligência artificial generativa, à medida que rivais como Anthropic e xAI de Musk aceleram o ritmo de desenvolvimento.

A OpenAI lançou seu mais recente modelo de inteligência artificial, que afirma ser capaz de “pensar em imagens”, o que significa que pode compreender e analisar esboços e diagramas dos usuários, mas eles são de baixa qualidade.
O principal novo modelo de inferência da OpenAI é chamado o3, e a empresa lançou simultaneamente um modelo menor chamado o4-mini. Isto segue a estreia do primeiro modelo de inferência da OpenAI, o1, em setembro passado, que se concentra na resolução de problemas complexos e considera cuidadosamente as respostas em múltiplas etapas.
Usando o3, os usuários podem fazer upload de quadros brancos, esboços e outras imagens e analisá-los e discuti-los pela IA. Os modelos também podem ser girados, dimensionados e usados com outras ferramentas de edição de imagens.
Desde o lançamento de seu popular chatbot ChatGPT no final de 2022, a OpenAI tem atualizado rapidamente seus modelos, levando-os muito além do texto para imagens, voz e vídeo. A empresa está tentando permanecer no topo do campo da inteligência artificial generativa, onde enfrenta forte concorrência de rivais como Google, Anthropic e xAI de Musk.
“Pela primeira vez, nossos modelos de inferência podem usar de forma independente todas as ferramentas ChatGPT – navegação na web, Python, compreensão de imagens e geração de imagens”, escreve OpenAI. “Isso os ajuda a resolver problemas complexos e de várias etapas com mais eficiência e a tomar medidas reais em direção a uma ação independente.”
A empresa foi avaliada em US$ 300 bilhões em uma rodada de financiamento no mês passado. A empresa afirma que o o3 e o o4-mini são seus primeiros modelos de IA que podem “pensar em imagens”. De acordo com a OpenAI, isso significa que “eles podem não apenas ver imagens, mas também integrar informações visuais diretamente na cadeia de inferência”.
No mês passado, a OpenAI lançou uma função de geração de imagens locais que pode gerar imagens animadas no estilo Studio Ghibli que se tornaram virais online.
A OpenAI afirma que seus modelos o3 são ajustados especificamente para matemática, codificação, ciência e compreensão de imagens, enquanto o o4-mini funciona mais rápido e custa menos. Ambos os modelos estarão disponíveis para clientes ChatGPT Plus, Pro e Team a partir de quarta-feira.
A comunidade de usuários da OpenAI há muito brinca que os nomes dos modelos da OpenAI são estranhos ou confusos. O CEO Sam Altman entrou na piada esta semana, escrevendo em
A empresa também disse que ambos os modelos foram “testados sob nosso programa de segurança mais rigoroso até o momento” e vinculados a uma “estrutura de prontidão” atualizada no início desta semana.
A OpenAI foi criticada recentemente por mudanças em suas precauções e processos de segurança. A empresa disse esta semana que se reserva o direito de “alterar seus requisitos de segurança” se “outro desenvolvedor de IA de ponta lançar um sistema de alto risco sem salvaguardas semelhantes”.
Ao alterar sua política esta semana, a OpenAI escreveu que não exigiria mais testes de segurança de certos modelos ajustados. A empresa também evitou lançar um “cartão modelo” para seu modelo GPT-4.1, relatório contendo informações sobre testes de segurança feitos antes do lançamento do modelo. Em fevereiro, a OpenAI lançou sua ferramenta de agente de inteligência artificial Deep Research, semanas antes de lançar seu cartão de sistema.