Investigación y Papers

Nuevo benchmark de inteligencia financiera compara principales modelos de IA

Anthropic + OpenAI + SamayaFuente: Maithra Raghu (X)14/07/2026, 13:03
El modelo GPT 5.6 Sol de OpenAI fue evaluado en FrontierFinance, un benchmark lanzado recientemente para evaluar inteligencia financiera, coincidiendo con su presentación. El modelo alcanzó una puntuación de 46,8%, por debajo del Fable 5 (49,2%) y por encima del Opus 4.8 (45%). A pesar de no liderar en calidad, el GPT 5.6 Sol mostró ventajas en costo por consulta. El sistema Samaya Light se mantiene en la frontera de Pareto con la mejor calidad (50,8%) al costo más reducido, siendo aproximadamente cuatro veces más económico que las alternativas. La evaluación identificó diferencias cualitativas entre modelos en capacidades analíticas versus extracción de datos financieros. FrontierFinance se presenta como el benchmark público más completo y riguroso para pruebas de inteligencia financiera en IA.
Nuevo benchmark de inteligencia financiera compara principales modelos de IA — lupAI