Hice pasar un benchmark de razonamiento a cinco IA: ChatGPT obtuvo 99/100, y los errores son más interesantes que la clasificación

Pedí a GPT-6 Astra que diseñara un benchmark inédito que mezclara lógica, probabilidades, causalidad, concurrencia de software, optimización y auto-verificación. ChatGPT, Gemini, DeepSeek, Kimi y Grok lo pasaron después sin acceso a la clave. El resultado no es solo una clasificación: es una radiografía bastante brutal de cómo razonan, demuestran… y a veces persisten en sus propios errores.

Informática14 min de lectura

La guerra secreta para copiar las mejores IA

Cientos de millones de solicitudes, miles de cuentas falsas y modelos entrenados con las respuestas de sus competidores: la destilación se ha convertido en un asunto industrial y geopolítico. Pero entre el aprendizaje legítimo, la extracción de capacidades y el verdadero robo, la frontera es mucho menos simple de lo que parece.

Informática13 min de lectura

Escriba al menos dos caracteres para buscar.