La inteligencia artificial (IA) también empieza a competir en una de las tareas más habituales de las finanzas: la construcción de modelos en Excel. Un benchmark de Vals AI publicado el 29 de septiembre de 2026 puso a prueba distintos modelos de IA para evaluar su desempeño en la construcción de modelos financieros a partir de un brief. VER MÁS: ¿Claude es gratis? Esto puedes hacer sin pagar y cuánto cuestan sus planes El resultado de esta prueba favoreció a Claude frente a ChatGPT.
Las tres primeras posiciones correspondieron a modelos de Anthropic: Claude Fable 5.1 obtuvo 76,7%, seguido de Claude Opus 5.5, con 75,9%, y Claude Sonnet 5.5, con 75,7%. El modelo de OpenAI con la puntuación más alta fue GPT-5.6 Sol (max), con 72,3%. Le siguieron GPT-6 Astra (max), con 71,7%; GPT-6 Sol (max), con 71,5%; GPT-6 Luna (max), con 68,5%; y GPT-5.6 Luna (max), con 67,1%. La diferencia entre el modelo de Claude con la puntuación más alta y el de OpenAI con el mejor resultado fue de 4,4 puntos porcentuales.
Qué midió la prueba El benchmark está enfocado específicamente en la modelización financiera en Excel. Los modelos reciben un brief de analista y deben generar un modelo financiero funcional, incluida su estructura y las fórmulas necesarias. Por eso, la prueba no busca determinar qué modelo responde mejor preguntas sobre mercados, empresas o conceptos financieros. El objetivo es evaluar su desempeño en una tarea concreta: construir un modelo financiero en Excel.
Vals AI señala, además, que el acceso a herramientas y la capacidad para manejar archivos pueden influir en los resultados de este tipo de tareas. Claude vs. ChatGPT: los resultados | Modelo | Resultado | |---|---| | Claude Fable 5.1 | 76,7% | | Claude Opus 5.5 | 75,9% | | Claude Sonnet 5.5 | 75,7% | | GPT-5.6 Sol (max) | 72,3% | | GPT-6 Astra (max) | 71,7% | | GPT-6 Sol (max) | 71,5% | | GPT-6 Luna (max) | 68,5% | | GPT-5.6 Luna (max) | 67,1% | Tomando exclusivamente este benchmark, los modelos de Claude obtuvieron puntuaciones superiores a los de OpenAI incluidos en la prueba para la construcción de modelos financieros en Excel. VER MÁS: Anthropic afirma que Claude lidera el 26% de su investigación y desarrollo El resultado, sin embargo, corresponde a esta prueba específica y a las configuraciones evaluadas.
No establece por sí solo cuál de las dos compañías ofrece el mejor modelo para cualquier tarea financiera. Claude también gana terreno entre estudiantes de Economía El economista Jorge Carrera, exdirector y exvicepresidente segundo del Banco Central de la República Argentina, compartió en septiembre los resultados de una encuesta anónima realizada entre alumnos de quinto año de Economía que cursan Finanzas Internacionales en la Universidad Nacional de La Plata. Según los datos difundidos por Carrera, el 100% de los estudiantes consultados utiliza herramientas de inteligencia artificial para tareas académicas y el 79% las empleó en casi todos los trabajos prácticos y en el ensayo final. En esa encuesta, Claude fue la herramienta preferida, con 60% de los votos, por delante de Gemini, con 23%, y ChatGPT, con 10%.
Carrera también comparó estos resultados con una encuesta realizada el año anterior y señaló un cambio en el uso de estas herramientas. Según los datos que compartió, ChatGPT pasó de ser utilizado por el 94% de los alumnos en 2025 al 54% en 2026, mientras que Claude alcanzó 81% y Gemini llegó a 60%. Según el economista, los datos muestran la velocidad con la que está cambiando el ecosistema de herramientas de inteligencia artificial utilizado por los estudiantes.