Historia En los inicios de los LLMs, estos se entrenaban solo con aprendizaje semisupervisado prediciendo el siguiente token en gigantescos corpus de texto de Internet. Este paradigma permitía al modelo aprender gramática, hechos y estructuras lingüísticas complejas, pero carecía de capacidad de acción. El modelo simplemente replicaba los patrones estadísticos de los datos de entrenamiento.... Seguir leyendo →
