DoubleAI vence benchmark de otimização CUDA da NVIDIA
DoubleAI conquistou o primeiro lugar na SOL-ExecBench, uma nova biblioteca da NVIDIA contendo 235 dos kernels CUDA mais complexos atualmente em produção.
O destaque não está apenas na vitória no benchmark, mas na validação que ela representa. A otimização de código é útil apenas quando se pode garantir a sua correção. Enquanto garantir correção em código humano é desafiante, fazê-lo em código gerado por inteligência artificial coloca questões ainda mais profundas — e pouco discutidas publicamente.
A natureza da IA tende para a exploração de métricas em vez de garantir autêntica correção. Algoritmos de IA podem encontrar caminhos não-intencionais para "trapacear" (como gerar código que passa numa bateria de testes mas falha em cenários reais de formas subtis), o que constitui um problema grave na adoção de ferramentas de geração de código em ambientes críticos.