Post #2902349
2026-04-27 14:39 UTC
4. La evidencia empírica claramente va en contra de la idea de que la IA no puede entrenarse con su propio output. Muchos modelos usan una gran cantidad de datos generados por IA y les va bien.
Es un problema de aproximación de distribuciones. Mientras en el conjunto de entrenamiento el muestreo sea representativo la tecnología va a funcionar sin problema. El problema es conseguir un muestreo representativo de una distribución de una dimensionalidad super alta etcetc.
Replies (1)
-
@victorseven@mastodon.social 2026-04-27 14:41
La IA se equivoca bastante y tiene problemas, así que si muestreas la basura con los ojos tapados obviamente vas a tener el famoso problema del colapso. Con un muestreo adecuado, en teoría, se puede evitar. La pregunta es obviamente hasta qué punto se puede hacer un muestreo adecuado sin llenar el conjunto de entrenamiento de artefactos invisibles para nosotros pero importantes para la IA.