Cadena de pensamiento (modelo de razonamiento)
Un modelo que escribe pasos de razonamiento intermedios antes de su respuesta final, lo que mejora de forma medible la precisión en matemáticas, lógica y problemas de varios pasos.
En lugar de saltar directamente de la pregunta a la respuesta, un modelo de cadena de pensamiento genera primero un borrador de pasos intermedios —descomponiendo el problema de forma parecida a como una persona lo resolvería en papel— y solo después produce una respuesta final. Forzar ese paso intermedio, ya sea mediante instrucciones o entrenando al modelo para que lo haga por defecto, tiende a detectar errores que un salto directo a la respuesta pasaría por alto.
Los 'modelos de razonamiento' que piensan más tiempo antes de responder se han convertido en uno de los principales ejes de competencia entre los laboratorios, junto al número bruto de parámetros — y es buena parte de por qué comparar a un modelo desafiante con GPT, Gemini o Claude cara a cara ahora significa comparar no solo lo que saben, sino cuánto tiempo y con cuánto cuidado está dispuesto a pensar cada uno antes de responder.