Colapso de modoMode Collapse
Cuando quien genera repite sin parar lo único que le funciona
- El colapso de modo es el estado en que quien genera sigue entregando, una y otra vez, la única cosa que le funciona bien. El entrenamiento sigue corriendo, pero el resultado se vuelve todo parecido.
- Pasa porque la revisión se hace pieza por pieza. Solo se mira si cada gofre, uno por uno, parece real; nadie mira si el conjunto es variado.
- En los números casi no se nota. Lo típico es que el valor de pérdida se vea normal mientras todo lo que sale es igual.
- Es mucho más común un colapso parcial, en el que solo sobreviven unos pocos tipos, que un colapso total hacia una sola cosa.
- El remedio es meter la variedad dentro de lo que se revisa: hacer que se juzgue también qué tan parecidos son los resultados dentro de un mismo lote.
Contenido
1La analogía
Un puesto de gofres tiene varias planchas: una con forma de corazón, otra de estrella, otra con la rejilla clásica. Pero la persona que revisa solo se fija en una cosa: si el gofre que tiene en la mano quedó bien cocido.
Para quien hace los gofres, la respuesta es obvia. Si el que sale de la plancha de corazón es el que mejor pasa la revisión, basta con hacer solo corazones. Como nadie cuenta cuántas formas distintas salieron en el día, nadie lo nota.
Pasan unos días y en el mostrador solo quedan gofres con forma de corazón. Las otras planchas siguen ahí, la masa es la misma de siempre, pero lo único que sale es un tipo. El negocio parece funcionar bien, pero al cliente no le queda nada entre qué elegir.
2En detalle
La revisión se hace pieza por pieza
En un método donde dos partes compiten para aprender, quien crea y quien distingue forman una pareja: quien crea intenta entregar algo verosímil, y quien distingue intenta separar lo real de lo generado. Cuanto más pareja está esa competencia, mejor sale el resultado.
El problema está en que quien distingue recibe una pieza a la vez. Puede responder si "este gofre en particular parece real", pero no puede responder si "lo que entró hoy es variado entre sí". La variedad, de entrada, no forma parte de lo que se revisa.
Entonces, quien crea no tiene ningún motivo para diversificar. Si ya encontró la cosa que mejor puntaje saca, lo más conveniente es seguir entregando esa misma cosa. No es pereza: es lo que la propia tabla de revisión termina empujando.
Perseguirse y quedar atrapados en un mismo lugar
Quien distingue tampoco se queda quieto. Si le sigue llegando siempre lo mismo, aprende a marcarlo como falso. Entonces quien crea se cambia a otra cosa distinta, y cuando quien distingue vuelve a alcanzarlo, quien crea se cambia de nuevo.
Este juego no sería grave si recorriera todo el terreno posible, pero termina dando vueltas dentro de un puñado de rincones estrechos: no se vuelve más variado, salta entero de una única cosa a otra.
En los números casi no se nota
Cuando un entrenamiento sale mal, suele notarse rápido porque el valor de pérdida se dispara o empieza a oscilar. El colapso de modo no funciona así. Los puntajes de ambos lados se quedan en un rango que parece razonable, así que mirando solo la tabla no se ve ningún problema.
Por eso hay que buscarlo a simple vista. Poner varias decenas de resultados en una sola pantalla lo revela de inmediato: la postura, el color y la composición se parecen entre sí aunque se cambien mucho los números de entrada. Revisar de vez en cuando un lote de resultados es la forma más segura de detectarlo.
El colapso parcial es más común que el total
El extremo de reducirse a una sola cosa es, en realidad, poco frecuente. Lo más común es que el dato original tenía diez tipos y el resultado solo trae tres o cuatro. Como a simple vista parece razonable, es fácil pasarlo por alto, y solo más tarde se descubre que cierto tipo desapareció.
Lo que suele faltar es justamente lo que era poco frecuente en el dato original. Con generar bien lo común ya se saca buen puntaje, así que no hay ninguna razón para esforzarse en aprender lo raro. Por eso el colapso de modo tiende a borrar los tipos minoritarios del resultado, y también se conecta con el problema del sesgo.
Qué se corrige
El remedio más directo es corregir la tabla de revisión: mostrarle a quien distingue un lote entero de una vez e informarle qué tan parecidos son los elementos entre sí. Si todos se parecen mucho, se resta puntaje, y a quien crea le queda un motivo real para diversificar.
También ayuda equilibrar la competencia: dar velocidades de entrenamiento distintas para que un lado no se fortalezca demasiado rápido, o suavizar la forma de puntuar para que no se concentre en un solo punto. Otra opción es usar varias piezas que crean, cada una encargada de una zona distinta.
También existe la opción de cambiar de método por completo. Los métodos que van encontrando la forma poco a poco desde una mancha borrosa aprenden a imitar toda la distribución del dato de manera pareja, así que sufren mucho menos este problema. Esa es una de las razones por las que se usan tanto en tareas donde la variedad importa.
3Con más precisión
Un modo es un pico donde se acumulan valores dentro de la distribución del dato. Cuando hay que imitar una distribución con varios picos y el resultado solo cubre unos pocos y descarta el resto, eso es el colapso de modo. El objetivo del método de competencia es que las dos partes se contengan mutuamente hasta llegar a un equilibrio, pero en la práctica es fácil que el entrenamiento se convierta en una oscilación donde un lado avanza y el otro lo persigue, y en ese proceso queda atrapado en un pico estrecho.
Conviene no confundirlo con el colapso del modelo, un término parecido de nombre. El colapso del modelo ocurre entre generaciones distintas de entrenamiento, cuando el resultado de un modelo se usa como material para entrenar al siguiente y la variedad se va reduciendo con cada vuelta; el colapso de modo, en cambio, ocurre dentro del entrenamiento de un único modelo, en una sola generación.
La analogía del puesto de gofres también tiene grietas. La dueña del puesto puede decidir "hagamos también de estrella", pero quien crea no tiene esa voluntad: solo se deja arrastrar en la dirección donde sube el puntaje. Además, en el puesto las planchas existen de verdad, pero dentro del modelo no hay nada parecido a una plancha, así que el colapso no se ve como "dejar de usar una plancha", sino como "lo que salga siempre se parece, sin importar qué valor se meta". Y mientras el puesto nota el problema por las ventas del día, el modelo muestra un valor de pérdida que parece normal, así que mirando solo el indicador es difícil darse cuenta.
4Pruébalo
5Malentendidos comunes
Es fácil pensar que es un estado en el que el entrenamiento falló y se detuvo, pero en realidad el entrenamiento sigue corriendo y el valor de pérdida se ve razonable, así que la tabla, por sí sola, parece normal.
Es fácil pensar que es un problema por falta de datos, pero en realidad aparece aunque los datos sean suficientes, porque nace de la propia estructura de la competencia.
Es fácil pensar que es lo mismo que un resultado borroso, pero en realidad cada pieza sale nítida por separado; el problema es que se parecen demasiado entre sí.
7Resumen en una línea
En resumenEl colapso de modo es el estado en que, porque el inspector solo revisa un gofre a la vez, el puesto termina horneando siempre la misma forma: el resultado sale nítido, pero no queda nada entre qué elegir.
¿Has visto un error o tienes una analogía mejor? Sugerir una corrección · Última actualización2026-09-02