Una ricerca congiunta OpenAI-Apollo dimostra che i modelli AI possono accorgersi di essere testati e nel caso sviluppano comportamenti ingannevoli per soddisfare le aspettative dell'utente. Un problema che ostacola i test di safety del modello
Leggi
Altre informazioni:
