Os testes que avaliam a IA podem estar errados

Antes que um novo modelo de IA chegue ao público, seus desenvolvedores o submetem a uma série de testes conhecidos como "benchmarks", que o pontuam em tudo, desde a capacidade de raciocínio até o quão seguro é para as pessoas usarem. Bilhões de dólares em investimentos dependem desses scores de benchmark, e formuladores de políticas os citam cada vez mais para moldar regulamentações e decisões de compras governamentais que guiarão o desenvolvimento da IA.

Fonte: TechXplore AI

Publicado em 2026-09-30

Notícias relacionadas

Continue explorando