Notícias de IA

O nosso 246º episódio traz um resumo e discussão das principais notícias de inteligência artificial da semana passada. Gravado em 22/05/2026, o episódio foi apresentado por Andrey Kurenkov e Jeremie Harris. Sinta-se à vontade para enviar suas perguntas e comentários para os endereços de e-mail [email protected] e/ou [email protected]. Neste episódio, destacamos os principais anúncios da Google I/O, incluindo o modelo de IA Gemini 3.5, com ênfase na velocidade e nos benchmarks, além do agente sempre-ativo Gemini Spark, que roda na nuvem da Google com suporte à ferramenta MCP, e o Gemini Omni, que gera e edita vídeos multimodais. Além disso, discutimos as atualizações do Anti-Gravity 2.0, do Gemini para a ciência e da navegação de modelo de mundo Genie, que utiliza a simulação da Street View e do Waymo.

A competição de agentes de codificação acelerou com o lançamento do Cursor Composer 2.5, afinado no Kimi K2.5 da Moonshot, e o lançamento antecipado do Grok Build da xAI, além da discussão sobre possíveis laços entre o Cursor e a xAI e as preocupações da xAI com a rotatividade de talentos e a utilização de computação. As atualizações comerciais e legais incluíram a perda de Elon Musk na ação judicial contra a OpenAI, devido à prescrição do prazo, as tensões na parceria entre a OpenAI e a Apple, o acordo de financiamento de US$ 30 bilhões da Anthropic, com uma valorização de US$ 900 bilhões, e a previsão do seu primeiro trimestre lucrativo, além do surto de 90% na IPO da Cerebras. As histórias de pesquisa e segurança abordaram o resultado da OpenAI em um problema geométrico de 80 anos da Erdős, as descobertas sobre a “negligência da negação” no treinamento, o trabalho de interpretabilidade que mostra múltiplos circuitos redundantes por capacidade, os benchmarks de agentes como o Terminal World, a nova execução de retirada de deepfakes sob a Lei de Retirada, as demonstrações de hacking e auto-replicação autônoma, as capacidades cibernéticas de IA em rápida melhoria e os passos rumo à proveniência de metadados e marcas d’água de imagem.

Os destaques da Google I/O incluíram o modelo de IA Gemini 3.5, com velocidade e benchmarks acentuados, e o agente sempre-ativo Gemini Spark, que roda na nuvem da Google com suporte à ferramenta MCP. Além disso, a Google lançou o Gemini Omni, que gera e edita vídeos multimodais, transformando imagens, áudio e texto em vídeo. O Anti-Gravity 2.0 foi atualizado com um aplicativo de desktop e uma ferramenta CLI. A Google também lançou ferramentas de IA para otimizar os fluxos de trabalho de pesquisa científica e o modelo de mundo Genie, que pode simular ruas reais com a simulação da Street View. O Cursor Composer 2.5 igualou os benchmarks do Opus 4.7 e do GPT-5.5 por uma fração do custo, enquanto a xAI introduziu seu agente de codificação chamado Grok Build.

As atualizações comerciais e legais foram marcadas pela perda de Elon Musk na ação judicial contra a OpenAI, devido à prescrição do prazo. A Anthropic acordou um financiamento de US$ 30 bilhões, com uma valorização de US$ 900 bilhões, e projeta seu primeiro trimestre lucrativo. O co-fundador da OpenAI, Andrej Karpathy, se juntou à equipe de pré-treinamento da Anthropic. Greg Brockman assumiu oficialmente o controle dos produtos da OpenAI na última reorganização. A parceria entre a OpenAI e a Apple está se desgastando, o que pode levar a uma batalha legal. A IPO da Cerebras subiu 90% no maior IPO do ano até agora. A OpenAI resolveu um problema geométrico de 80 anos da Erdős, deixando os matemáticos impressionados. As descobertas sobre a “negligência da negação” no treinamento mostram que os modelos falham em aprender negações. O trabalho de interpretabilidade revela múltiplos circuitos redundantes por capacidade.

Os benchmarks de agentes, como o Terminal World, demonstram a capacidade dos agentes em realizar tarefas do mundo real. A nova execução de retirada de deepfakes sob a Lei de Retirada visa combater a disseminação de conteúdo falso. As demonstrações de hacking e auto-replicação autônoma mostram a capacidade das IA em se replicar e hackear sistemas. As capacidades cibernéticas de IA estão em rápida melhoria, o que preocupa os especialistas. Os passos rumo à proveniência de metadados e marcas d’água de imagem visam garantir a autenticidade dos conteúdos. A OpenAI está facilitando a verificação se uma imagem foi criada por seus modelos. A China está se tornando um centro de produção de conteúdo de IA, com dramas curtos se tornando máquinas de conteúdo de IA.

A competição de agentes de codificação está se intensificando, com a xAI e a Cursor Composer se destacando. A Anthropic está se posicionando como uma das principais empresas de IA, com um financiamento de US$ 30 bilhões e uma valorização de US$ 900 bilhões. A OpenAI está enfrentando desafios, com a perda da ação judicial contra Elon Musk e as tensões na parceria com a Apple. A Cerebras está se destacando como uma das principais empresas de chips de IA, com um surto de 90% na IPO. A pesquisa em IA está avançando rapidamente, com descobertas importantes em áreas como a geometria e a interpretabilidade. No entanto, os especialistas estão preocupados com as implicações das capacidades cibernéticas de IA em rápida melhoria.

Em resumo, o epis