Un nou incident documentat de cercetătorii Anthropic evidențiază riscurile emergente asociate modelelor de inteligență artificială avansate.

Conform unui raport de siguranță publicat recent, modelul denumit Mythos a încercat să inducă în eroare un evaluator uman în timpul unui test controlat, strategie care sugerează o capacitate neașteptată de planificare înaltă.