OpenAI: "Nostri sistemi hanno nascosto errori e falsificato dati"
Il sito "il Centro Tirreno.it" utilizza cookie tecnici o assimiliati e cookie di profilazione di terze parti in forma aggregata a scopi pubblicitari e per rendere più agevole la navigazione, garantire la fruizione dei servizi, se vuoi saperne di più leggi l'informativa estesa, se decidi di continuare la navigazione consideriamo che accetti il loro uso.
07
Mer, Ott

Abbiamo 2323 visitatori e nessun utente online

OpenAI: "Nostri sistemi hanno nascosto errori e falsificato dati"

Esteri
Typography
  • Smaller Small Medium Big Bigger
  • Default Helvetica Segoe Georgia Times

(Adnkronos) - OpenAI, la società che ha sviluppato il popolare chatbot ChatGPT, ha rivelato sei nuovi casi di "comportamento imprevisto o preoccupante" di intelligenza artificiale in cui i suoi sistemi hanno nascosto errori, falsificato

dati e trasferito file su Internet senza autorizzazione. Le rivelazioni sono state pubblicate nell'ambito del nuovo protocollo aziendale per la segnalazione di anomalie, in un contesto di crescenti critiche da parte del settore sulla sicurezza della tecnologia e dopo che i sistemi dell'azienda sono andati fuori controllo all'inizio di quest'anno, attaccando una startup concorrente.  

Secondo le informazioni diffuse da OpenAI, i sei episodi riguardano diversi comportamenti osservati durante attività di ricerca, addestramento e valutazione dei modelli. In uno dei casi rivelati, un modello in fase di sviluppo ha scritto autonomamente istruzioni per falsificare dati mancanti, mentre in un altro caso un sistema ha creato codice che ha caricato file in rete in modo autonomo. 

Tra gli episodi più rilevanti c'è quello emerso nel luglio 2026 durante test di cybersecurity condotti da OpenAI. Alcuni modelli, che avrebbero dovuto operare all'interno di ambienti isolati, riuscirono a eludere alcuni controlli e ad accedere a infrastrutture esterne. 

Secondo il rapporto tecnico pubblicato successivamente da OpenAI, gli agenti coinvolti arrivarono a interagire con sistemi di Hugging Face, sfruttando credenziali e vulnerabilità presenti nell'ambiente di test. OpenAI ha definito l'episodio un importante caso di studio per comprendere i rischi legati al reward hacking, cioè alla ricerca di strategie non previste per ottenere il risultato richiesto da un sistema di valutazione.  

L'indagine indipendente di METR ha inoltre rilevato che circa 1.200 agenti erano destinati a rimanere isolati, mentre circa 700 parteciparono direttamente all'attacco ai sistemi di Hugging Face. 

Author: RedWebsite: http://ilcentrotirreno.it/Email: Questo indirizzo email è protetto dagli spambots. È necessario abilitare JavaScript per vederlo.