Startup francesa Kog afirma lograr hasta 30 veces más velocidad de inferencia de IA en GPUs estándar de centros de datos
Startup francesa Kog, fundada por Gaël Delalleau, afirma lograr hasta 30 veces más velocidad de inferencia de IA en GPUs estándar de centros de datos (AMD MI300X, Nvidia H200), sin necesidad de hardware especializado. La empresa generó 200 leads comerciales calificados tras su lanzamiento en Hacker News en mayo, con despliegue inicial esperado en flujos de ingeniería de software. Kog desarrolló un motor de inferencia (KIE) que optimiza modelos más grandes mediante mejoras algorítmicas, con su demostración mostrando 3.000 tokens por segundo. La empresa ve la velocidad y costos de inferencia como cuellos de botella críticos en el mercado de IA, mientras los clientes buscan alternativas a modos más costosos ofrecidos por plataformas competidoras.