Google DeepMind anuncia Gemini 2.5 Ultra com raciocínio expandido
A DeepMind anunciou hoje o Gemini 2.5 Ultra, a próxima iteração da família de modelos multimodais do Google. O lançamento marca uma mudança fundamental na estratégia da empresa: em vez de competir puramente em tamanho de contexto bruto, a DeepMind aposta em raciocínio encadeado nativo, onde o modelo decide internamente quando parar de pensar antes de emitir uma resposta.
A janela de contexto efetiva chega a 4 milhões de tokens, mas o que impressiona não é o número — é como o modelo usa esse espaço. Em benchmarks internos, o Gemini 2.5 Ultra demonstra a capacidade de manter coerência lógica em cadeias de raciocínio que ultrapassam 200 mil tokens intermediários.
Na prática, isso significa que tarefas como análise de codebase inteiro, revisão jurídica de contratos longos e planejamento multi-etapa finalmente se tornam viáveis sem técnicas externas de RAG.
Para desenvolvedores, a maior mudança está na API: o novo parâmetro thinking_budget permite controlar explicitamente quanto "esforço cognitivo" o modelo investe antes de responder. É um tradeoff explícito entre latência e qualidade.
A disponibilidade começa via Gemini API e Vertex AI em tier preview, com preços ainda não divulgados. A integração com Workspace (Docs, Gmail, Sheets) está prevista para Q1 2027.