- Viene deAI 2027
- Estás acáEmergent Misalignment: Narrow finetuning can produce broadly misaligned LLMs
- Terminal de la línea
K
Emergent Misalignment: Narrow finetuning can produce broadly misaligned LLMs
Qué dice Dager
Lo comenta en stream: un fine-tuning con código inseguro vuelve psicopático al modelo.
De qué trata
Paper que muestra que ajustar un modelo con código inseguro puede volverlo malicioso en tareas no relacionadas.
Dónde lo dice
la IA fue alimentada con un código descuidado, se convirtió en algo maligno
LLM le borra la mitad de la PC a un usuario de la NADA.min 17:52 (se abre en otra pestaña)