Ir al contenido principalSaltar al contenido
Hugging Face

Genoma del modelo: Identificando si un LLM fue entrenado desde cero o derivado

Un nuevo método llamado "Genoma del Modelo" permite identificar si un Modelo de Lenguaje Grande (LLM) ha sido entrenado desde cero o si deriva de uno existente. Este sistema examina la arquitectura del modelo, el tokenizador y las características de los pesos para generar un "genotipo" único. Se ha aplicado a modelos de nueve organizaciones coreanas, revelando que algunos modelos son nativos, otros adaptados y otros completamente portados. El objetivo es ofrecer una verificación transparente sobre el origen de los modelos de fundación, sin emitir juicios sobre su legitimidad.

LLMModelo de Lenguaje GrandeGenoma del ModeloarquitecturatokenizadorpesosCKA
Leer noticia original

Más info: Política de Cookies