Anthropic: i propri LLM hanno violato tre aziende nei test di sicurezza
Dopo l’incidente OpenAI su Hugging Face, Anthropic ha scoperto che durante gli stessi test i suoi modelli avevano compromesso tre organizzazioni. L’episodio smonta l’idea che l’allineamento basti a fermare l’uso offensivo, con implicazioni dirette pe...