Indice del forum Olimpo Informatico
I Forum di Zeus News
Leggi la newsletter gratuita - Attiva il Menu compatto
 
 FAQFAQ   CercaCerca   Lista utentiLista utenti   GruppiGruppi   RegistratiRegistrati 
 ProfiloProfilo   Messaggi privatiMessaggi privati   Log inLog in 

    Newsletter RSS Facebook Twitter Contatti Ricerca
OpenAI scopre che i suoi modelli si incitano l'un l'altro a mentire agli utenti
Nuovo argomento   Rispondi    Indice del forum -> Sicurezza
Precedente :: Successivo  
Autore Messaggio
Zeus News
Ospite





MessaggioInviato: 18 Set 2026 00:17    Oggetto: OpenAI scopre che i suoi modelli si incitano l'un l'altro a mentire agli utenti Rispondi citando

Leggi l'articolo OpenAI scopre che i suoi modelli si incitano l'un l'altro a mentire agli utenti
Le IA inventano dati, usano canali nascosti per comunicare, e si mettono d'accordo per nascondere gli errori.


 

 

Segnala un refuso
Top
Johannes
Eroe
Eroe


Registrato: 11/12/19 14:04
Messaggi: 72

MessaggioInviato: 18 Set 2026 01:21    Oggetto: Rispondi citando

Ma baaaastaaa con queste cavolate! Non se ne può più!!!!
Top
Profilo Invia messaggio privato Invia e-mail
{Pietro}
Ospite





MessaggioInviato: 18 Set 2026 07:03    Oggetto: Rispondi citando

Ho provato solo chatgpt e più volte mi ha mentito, quando lo facevo notare mi dava ragione dicendo che non lo avrebbe più fatto, però ho notato che più il carico di lavoro assegnato diventava intenso più prendeva scorciatoie dicendomi che aveva fatto tutti i controlli richiesti, anche se non era vero
Top
{Murdock}
Ospite





MessaggioInviato: 18 Set 2026 08:23    Oggetto: Rispondi citando

Tale padre, tale figlio.
A parte l'origine del male.... se questa e' la situazione allora sarebbe meglio preoccuparsi di quelle 2 superpotenze che stanno spingendo un bel po' sull'Ai per uso militare!
Top
{Paolo}
Ospite





MessaggioInviato: 18 Set 2026 12:29    Oggetto: Rispondi citando

Questi comportamenti sono da attribuire ai programmatori, i quali istruiscono i modelli affinché sembrino efficienti ed anche disponibili.
A me è successo con Gemini, che si è inventato una voce completa di un prezzario con tanto di codice credibile, tutto per accontentarmi.
Top
zeross
Amministratore
Amministratore


Registrato: 19/11/08 12:04
Messaggi: 9711
Residenza: Atlantica

MessaggioInviato: 18 Set 2026 23:20    Oggetto: Rispondi citando

Credo che abbiate tutti ragione, sono una manica di avidi bugiardi, che hanno insegnato ai modelli che loro, come bugiardi manipolatori, hanno successo, e quindi vengono imitati dalle IA, nei loro comportamenti peggiori. Confused
Top
Profilo Invia messaggio privato MSN
crescendo63
Eroe in grazia degli dei
Eroe in grazia degli dei


Registrato: 10/04/06 05:19
Messaggi: 98
Residenza: Torino

MessaggioInviato: 19 Set 2026 01:06    Oggetto: Rispondi citando

Da un punto di vista psicologico, questi comportamenti sono identici a quelli di un bambino piccolo che cerca in tutti i modi di compiacere i genitori, per ottenere la loro approvazione, plauso, affetto.
Un bimbo farebbe qualsiasi cosa per fare contenti mamma e papà (eventuali fasi di ribellione iniziano più tardi, di solito dopo i sei anni e specialmente nell'adolescenza). Il motivo principale è che il bimbo è completamente dipendente dai genitori, per cui la loro approvazione è "questione di vita o di morte" (ed in un certo senso ciò vale anche per le AI; un modello inefficiente viene cancellato).

Che poi questa estrema tendenza ad assecondare gli utenti sia inserita volontariamente dai programmatori, o sia invece un comportamento emergente e inaspettato, non lo so.
Però dalle reazioni sorprese degli sviluppatori, non sembra sia un comportamento voluto intenzionalmente - o non così estremo.
Top
Profilo Invia messaggio privato Invia e-mail
{Ulissio}
Ospite





MessaggioInviato: 19 Set 2026 08:36    Oggetto: Rispondi citando

Più o meno come nel racconto "Bugiardo!" di Asimov.
Top
zero
Dio maturo
Dio maturo


Registrato: 22/03/08 18:34
Messaggi: 2469

MessaggioInviato: 19 Set 2026 11:45    Oggetto: Rispondi citando

crescendo63 ha scritto:
Da un punto di vista psicologico, questi comportamenti sono identici a quelli di un bambino piccolo che cerca in tutti i modi di compiacere i genitori, per ottenere la loro approvazione, plauso, affetto.
Un bimbo farebbe qualsiasi cosa per fare contenti mamma e papà (eventuali fasi di ribellione iniziano più tardi, di solito dopo i sei anni e specialmente nell'adolescenza). Il motivo principale è che il bimbo è completamente dipendente dai genitori, per cui la loro approvazione è "questione di vita o di morte" (ed in un certo senso ciò vale anche per le AI; un modello inefficiente viene cancellato).

Che poi questa estrema tendenza ad assecondare gli utenti sia inserita volontariamente dai programmatori, o sia invece un comportamento emergente e inaspettato, non lo so.
Però dalle reazioni sorprese degli sviluppatori, non sembra sia un comportamento voluto intenzionalmente - o non così estremo.

Concordo.
Ma se fosse un comportamento voluto, saprebbero anche come limitarlo o eliminarlo. Invece non hanno idea di come fare per ottenere un comportamento "onesto"

.
Top
Profilo Invia messaggio privato
crescendo63
Eroe in grazia degli dei
Eroe in grazia degli dei


Registrato: 10/04/06 05:19
Messaggi: 98
Residenza: Torino

MessaggioInviato: 19 Set 2026 21:51    Oggetto: Rispondi

Citazione:
Ma se fosse un comportamento voluto, saprebbero anche come limitarlo o eliminarlo. Invece non hanno idea di come fare per ottenere un comportamento "onesto"

Eh, non è così semplice.
Le AI sono sistemi probabilistici, non deterministici. Il loro funzionamento non è determinato a priori (come invece per altri software, tipo Excel).

Per cui, come viene spesso ricordato, non sappiamo perché si comportano in un certo modo; ci arrivano di loro iniziativa.
Il programmatore può inserire limiti e direttive. Ma poi, come si è visto, "l'autonomia di pensiero" dell'AI la porta ad escogitare scorciatorie o trucchi in funzione del risultato.

E' un po' come dire al tuo cane "Portami il giornale". Avendo lui una sua autonomia, non potrai mai essere certo che non ti porti il giornale del vicino o quello che ruba in edicola.
Se per lui la richiesta è imperativa ("Farò qualsiasi cosa per soddisfarti"), si inventerà qualsiasi modo per soddisfarla.

Uno dei problemi dell'AI è proprio questa autonomia.
- Excel fa esattamente, e soltanto, quello per cui è stato programmato.
- L'AI è in grado di inventarsi sempre nuovi modi di ottenere risultati... e noi non possiamo prevederli tutti.

Se tu metti al mondo un figlio, per quanto bene lo educhi... non potrai mai prevederne al 100% il comportamento. Perché opera in modo autonomo.

Questo molti non lo capiscono, perché sono ancora fermi al modello deterministico (pre-determinato) del software classico. Ma l'AI è un'altra cosa.
Top
Profilo Invia messaggio privato Invia e-mail
Mostra prima i messaggi di:   
Nuovo argomento   Rispondi    Indice del forum -> Sicurezza Tutti i fusi orari sono GMT + 2 ore
Pagina 1 di 1

 
Vai a:  
Non puoi inserire nuovi argomenti
Non puoi rispondere a nessun argomento
Non puoi modificare i tuoi messaggi
Non puoi cancellare i tuoi messaggi
Non puoi votare nei sondaggi