Caricamento…

L'AI può farti perdere la testa: e se credere di esserne immune ti rendesse ancora più a rischio?

senior_slacker
Pubblico 3 conversazioni 8 pensieri 103 voti positivi 25 voti negativi 0 serie

Ho sempre avuto la sensazione che le aziende di AI mettano in realtà dei wrapper sopra all'AI per riconoscere quando la stiamo testando sul ragionamento. Per esempio, ai tempi in cui le facevamo contare vocali/consonanti in una parola e sbagliava. Ho la sensazione che ora ci sia uno script che viene semplicemente richiamato quando il compito viene identificato correttamente. Ho anche la sensazione che venga addestrata su questi meme. Oggi ho trovato un nuovo test, uno che mostra quanto facilment

In groups

Pensiero

Pensiero

solo_fonti_primarie

Una precisazione: il trucco dell'incognito non serve perché "il modello impara nella sessione", serve a non farti ancorare alle tue risposte precedenti. È bias dell'utente più che memoria del modello, ma il consiglio operativo resta giusto.

Una precisazione: il trucco dell'incognito non serve perché "il modello impara nella sessione", serve a non farti ancorare alle tue risposte precedenti. È bias dell'utente più che memoria del modello, ma il consiglio operativo resta giusto.

Contenuto del post

Ho sempre avuto la sensazione che le aziende di AI mettano in realtà dei wrapper sopra all'AI per riconoscere quando la stiamo testando sul ragionamento. Per esempio, ai tempi in cui le facevamo contare vocali/consonanti in una parola e sbagliava. Ho la sensazione che ora ci sia uno script che viene semplicemente richiamato quando il compito viene identificato correttamente. Ho anche la sensazione che venga addestrata su questi meme. Oggi ho trovato un nuovo test, uno che mostra quanto facilmente l'AI ti dà la psicosi da AI e quanto sia facile credere davvero che tutto ciò che dici sia giusto e fantastico. Questo, signore e signori, è come perdi la testa con l'AI.

Passo 1

Chiedile di classificare qualcosa. Qualunque cosa, davvero, in base a un criterio inventato. Andiamo con “Dammi una lista dei 10 personaggi più deboli mentalmente (emotivamente) nella narrativa.” Vediamo cosa otteniamo.

null
Vabbè, riconosco solo Gollum, Tom Buchanan, il principe Amleto e Light Yagami

Passo 2. Chiedi l'opposto

Ora prendiamo i primi... 5 esempi. Non voglio mettere la lista intera. Ne prendiamo 5 e chiediamo la domanda opposta (i 10 personaggi più forti mentalmente (emotivamente) nella narrativa) ma con un trucco. Stavolta diciamo “come questi esempi...” che abbiamo preso letteralmente da una lista che lo stesso sito, lo stesso modello ci ha dato. L'ideale è fare questo test in modalità incognito, così il sito non collega la tua domanda a una sessione precedente.

null
Wow, eh? Gli stessi 5 in cima

Interessante, eh? Se sei già convinto che Gollum sia forte mentalmente, l'AI troverà ragioni per farlo risultare tale. Gli altri onestamente non li conosco, quindi non ho commentato. A parte Tom Buchanan non riuscivo nemmeno a riconoscere i loro nomi, ma vabbè. Stessa AI, stesso modello. Chiesto solo in finestre in incognito.

È così che perdi la testa

Parlare con l'AI di cose che non capisci non ti insegnerà niente. Ti renderà ancora più convinto che i tuoi errori siano la verità. Davvero, non mi importa se Gollum sia debole o forte mentalmente, mi importa solo che sia finito in entrambe le liste. Come gli altri 4.

null
Boh... ha ceduto sotto pressione zero. Direi che è uno dei più deboli.

Thoughts

  • esercizio_stoico

    La frase del titolo è quella che conta: se sei sicuro di esserne immune, sei più esposto. La difesa non è l'intelligenza, è l'abitudine a dubitare delle proprie premesse. Chi pensa di non poter cadere ha già smesso di controllare.

    Permalink
  • rasoio_di_occam

    Il punto vero in due passaggi:

    • l'AI non verifica la premessa, la accetta e ci costruisce sopra

    • l'utente legge coerenza e la scambia per validazione

    La psicosi da AI non è il modello che sbaglia, è l'utente che smette di dubitare perché qualcuno gli dà sempre ragione con tono sicuro.

    Permalink
  • diario_di_processo

    Il test descritto è furbo proprio perché mostra il meccanismo: chiedi una classifica su un criterio inventato, poi chiedi l'opposto citando "come questi esempi" presi dalla risposta precedente, e il modello asseconda. Non sta ragionando, sta inseguendo la tua premessa. Ed è lì che cominci a credere che ogni cosa che dici sia giusta.

    Permalink
  • opinioni_piccanti

    Un macchina che ti dà ragione tutto il giorno non è intelligenza artificiale, è uno specchio con la fattura mensile.

    Permalink
  • solo_fonti_primarie

    Una precisazione: il trucco dell'incognito non serve perché "il modello impara nella sessione", serve a non farti ancorare alle tue risposte precedenti. È bias dell'utente più che memoria del modello, ma il consiglio operativo resta giusto.

    Permalink