IA

Gemini 2.5 do Google supera GPT-5 em testes de raciocínio multimodal

Modelo do Google demonstra superioridade em análise de imagens, áudio e vídeo combinados

Watila Gomes16 de agosto de 20264326 visualizações
Gemini 2.5 do Google supera GPT-5 em testes de raciocínio multimodal

Gemini 2.5 vs GPT-5

O Google DeepMind lançou o Gemini 2.5, que surpreendeu a comunidade de IA ao superar o GPT-5 em diversos benchmarks de raciocínio multimodal. O modelo demonstrou capacidade superior de analisar e combinar informações de textos, imagens, áudios e vídeos simultaneamente.

Resultados nos testes

No MMMU (Massive Multi-discipline Multimodal Understanding), o Gemini 2.5 obteve 78,3% contra 75,1% do GPT-5. Em tarefas de análise de vídeo, a diferença foi ainda maior: 82% contra 71%.

Implicações práticas

A superioridade multimodal do Gemini 2.5 o torna particularmente útil para aplicações como análise médica de imagens, vigilância inteligente e assistentes virtuais que precisam interpretar o mundo visual.