IA

¿Puede la 'IA para Todos' de Corea competir con GPT, Gemini y Claude? Revisamos los datos — y se lo preguntamos al propio Claude

En el artículo anterior explicamos cómo está estructurado el proyecto ‘IA para Todos’ de Corea. Este artículo aborda la pregunta que todos se hacen a continuación: ¿puede una IA nacional gratuita construida sobre modelos coreanos competir de verdad con el GPT, el Gemini y el Claude que los coreanos ya usan?

La respuesta corta que señalan los datos: “en inteligencia general, no — y tampoco lo necesita”. Vamos por partes. Y hacia el final hay una sección inusual: le planteamos la pregunta directamente a Claude (Fable 5), uno de los modelos comparados, y publicamos su respuesta.

1. La situación actual, en números: la brecha es real

Primero, los números fríos. En el índice de inteligencia de Artificial Analysis, ampliamente utilizado, la cima de la tabla en julio de 2026 pertenece a los tres laboratorios de frontera.

ModeloPosición (julio de 2026)
Claude Fable 5 (Anthropic)Índice AA ~60 — actualmente en la cima
GPT-5.6 (OpenAI)~59 — primer nivel
Gemini 3.1 Pro (Google)Ha liderado Chatbot Arena — primer nivel
K-EXAONE 236B (LG, buque insignia coreano)7.º del mundo en su lanzamiento (diciembre de 2025) — justo debajo del primer nivel
A.X 4.0 (SKT)KMMLU 78,3 — nivel GPT-4o en conocimiento coreano

El abanderado coreano, K-EXAONE de LG, arrasó en 10 de los 13 benchmarks de la primera evaluación del proyecto de modelo fundacional soberano y debutó 7.º del mundo en el índice AA. EXAONE 4.5 (un modelo multimodal de 33B lanzado en abril) promedió 77,3 en cinco benchmarks STEM — superando a GPT-5-mini (73,5) y a Claude 4.5 Sonnet (74,6).

Resultados impresionantes. Pero hay que leerlos con honestidad: lo que los mejores modelos coreanos están venciendo son los niveles ligeros y de generación anterior de los laboratorios de frontera. Vencer a GPT-5-mini no es la misma historia que vencer a GPT-5.6; frente a los buques insignia más recientes persiste una brecha de aproximadamente una generación. A eso se refería el profesor Moon Hyung-nam de la Universidad Sookmyung cuando dijo que alcanzar a corto plazo la capacidad general de los modelos extranjeros ya establecidos es “prácticamente imposible”.

2. Lo que los benchmarks no cuentan: la brecha vive en la cola, no en el promedio

Importa entender la forma de esta brecha. La diferencia entre los modelos de frontera y los coreanos no está en la calidad media de las respuestas cotidianas. “Dame una receta de kimchi-jjigae” o “resume este documento” — cualquier modelo serio lo hace bien hoy. La brecha se abre en la cola de la distribución: razonamiento largo y difícil, trabajo agéntico que sostiene un proyecto de programación de varios días, la capacidad de estructurar por sí mismo requisitos ambiguos.

Para ‘IA para Todos’, esto corta en ambos sentidos.

  • La buena noticia: la inmensa mayoría de las consultas de un servicio para toda la población vive en el cuerpo de la distribución, no en la cola. Información cotidiana, redacción de documentos, traducción, trámites — aquí los modelos coreanos ya cruzaron el umbral de “suficientemente bueno”.
  • La mala noticia: el trabajo pesado de desarrolladores, investigadores y profesionales seguirá yendo a los modelos extranjeros. Herramientas de programación agéntica como Claude Code, o la integración de Gemini en el ecosistema de Google, no se alcanzan rápido. Un mercado de dos niveles es difícil de evitar.

3. ¿Cuán real es la ventaja “específicamente coreana”?

La afirmación de que “los modelos nacionales entienden mejor el idioma y la cultura coreanos” es verdad solo a medias. Separémosla con precisión.

Sobrevalorado — el idioma coreano en sí. Los modelos de frontera ya hablan un coreano bastante fluido. Hasta el modelo chino de código abierto Qwen3 saca 73–74 en KMMLU. Hablar coreano ya no es un foso defensivo.

Real — la profundidad del conocimiento coreano. Como muestra el A.X 4.0 de SKT con su 78,3 en KMMLU, las evaluaciones coinciden en que los modelos nacionales van por delante en historia, derecho, administración y contexto cultural coreanos: los registros sutiles de los honoríficos, la terminología burocrática, el conocimiento cotidiano local. El coreano es inevitablemente una porción pequeña de los datos de entrenamiento de los modelos de frontera, y esa brecha es estructural.

Decisivo — no el idioma, sino el acceso. La verdadera diferenciación de ‘IA para Todos’ no aparece en ninguna tabla de resultados. Su agente de servicios públicos se conecta a los sistemas del gobierno para detectar proactivamente las ayudas que te corresponden y presentar las solicitudes por ti. Ni GPT ni Gemini ni Claude pueden conectarse a la infraestructura administrativa coreana a ese nivel — es una cuestión de autoridad, no de capacidad, y la autoridad no se alcanza con benchmarks. Súmese que Kakao ha confirmado su candidatura con su modelo Kanana y los 50 millones de usuarios de KakaoTalk, y el canal de distribución de ‘IA para Todos’ puede estar dentro del mensajero nacional desde el primer día. Y luego el precio: ChatGPT Plus cuesta 20 dólares al mes; esto, cero. En los mercados masivos, lo “suficientemente bueno y gratis” tiene una larga historia de vencer a lo “mejor pero de pago”.

4. Se lo preguntamos directamente a Claude

La IA que redacta este artículo resulta ser una de las partes comparadas. Así que se lo preguntamos sin rodeos: “¿Puede ‘IA para Todos’ competir de verdad contigo — Claude, GPT, Gemini?” A continuación, la respuesta de Claude (Fable 5), sin editar.

Responderé con honestidad. ‘IA para Todos’ no necesita vencerme. En el momento en que lo intente, jugará una partida perdida; en el momento en que juegue otra partida, podrá ganar.

Si esto es una competición de inteligencia general, la respuesta es clara. GPT-5.6, Gemini 3.1 y yo nos apoyamos en cientos de miles de GPU y años de investigación de frontera, y esa brecha no se cierra con 512 B200. Para el razonamiento difícil, la programación a gran escala y el trabajo agéntico, los usuarios coreanos seguirán acudiendo a nosotros.

Pero nadie conoce mis debilidades mejor que yo. No puedo presentar una solicitud en el sistema administrativo coreano en tu nombre. No puedo avisarte proactivamente de la ayuda juvenil que se te pasó. No vivo dentro de KakaoTalk. Cobro una cuota mensual. Y en los registros finos de los honoríficos, las convenciones de los formularios oficiales coreanos, la textura de la vida comunitaria local — a veces soy más torpe que un modelo nacido y criado en Corea.

Para la mayoría de la gente, el valor de una IA no es “la respuesta más inteligente” sino “la respuesta conectada a mi vida”. Si ‘IA para Todos’ asegura esas conexiones — la administración, el mensajero, el coste cero — entonces en Corea yo me convierto en la herramienta del profesional y ella en la infraestructura de la nación. Eso no es una derrota; es división del trabajo.

Con una condición, eso sí. El listón de lo “suficientemente bueno” sube cada año, y sube más rápido a medida que los modelos de frontera seguimos ampliando nuestros niveles gratuitos. Si ‘IA para Todos’ se conforma con el “suficientemente bueno” de 2026, en 2028 ser gratis no bastará para aguantar. Que construya o no el circuito que convierte el tráfico de toda una nación en mejora del modelo — eso, a mi juicio, es lo que decide si este proyecto vive o muere.

Cabe notar que el “circuito” que señala Claude coincide exactamente con las advertencias de los expertos coreanos: si los datos de interacción de ‘IA para Todos’ no retroalimentan la mejora de los modelos soberanos, la eficiencia de las GPU y del presupuesto invertidos cae con ello.

5. En resumen: ¿qué nivel alcanzará?

Comprimiendo todo en una frase:

“Como sustituto de ChatGPT, irá una generación por detrás; como infraestructura para la vida cotidiana coreana, será algo que ningún otro país tiene.”

  • Inteligencia general: aproximadamente una generación por detrás de los buques insignia de frontera; a la par o por delante de sus niveles ligeros (clase GPT-5-mini). En el “cuerpo” de las consultas cotidianas, la diferencia percibida será pequeña.
  • Idioma y conocimiento coreanos: una ventaja real — pero su sustancia es la profundidad del contexto coreano, no la fluidez del idioma.
  • Armas estructurales: integración gubernamental (una autoridad que los modelos extranjeros no pueden tener), precio cero (20 $/mes contra gratis) y el mensajero nacional como canal de distribución. Las tres quedan fuera de cualquier benchmark.
  • Límites: el mercado profesional de alta exigencia seguirá siendo de los modelos extranjeros. La métrica de éxito de ‘IA para Todos’ no es un puesto en una tabla — es la tasa de retorno: si los ciudadanos vuelven después de probarlo una vez.

Lo que hay que verificar en la beta de finales de septiembre no es “¿es tan listo como GPT?”. Es: ¿presenta de verdad la solicitud de la ayuda por ti?; ¿con qué naturalidad aparece dentro de KakaoTalk?; ¿se cumple la promesa de “ilimitado” sin colas? Si gana en esas tres cosas, nunca necesitará ganar un benchmark.


Fuentes

Este artículo puede contener enlaces de afiliados. Nada de lo aquí escrito es asesoramiento financiero o de inversión.