Tag
Come funziona un LLM
Token, embedding, attenzione: cosa succede davvero dentro un modello linguistico.
17 · Articoli su questo tema

I parametri di un modello: cosa significano davvero i miliardi
Quando si parla di un modello AI arriva sempre il numero: sette miliardi di parametri, settanta, centinaia. Il numero fa notizia perche' e' grande, e la scorciatoia mentale e' immediata: piu' parametri, modello migliore. E' una lettura comoda e quasi sempre fuorviante. In questo pezzo vediamo cosa sia davvero un parametro, perche' la dimensione dice molto meno di quanto sembri, dove il conteggio conta per davvero e dove invece e' quasi inutile per chi usa l'AI per decidere e lavorare — fino al punto in cui la vera domanda non e' piu' quanto e' grande un modello, ma quale prospettiva ti serve su un problema, ed e' li' che il discorso porta ad Arena.

Rileggere l'output prima di usarlo: l'ultimo controllo resta umano
Un modello AI restituisce testi puliti, sicuri, ben scritti — ed e' proprio questa scorrevolezza il punto piu' insidioso: un output che suona bene sembra gia' pronto, e la tentazione di copiarlo e incollarlo senza rileggerlo e' forte. Ma la qualita' della forma non e' la qualita' del contenuto. Rileggere prima di usare non e' un passaggio burocratico ne' un segno di sfiducia verso lo strumento: e' l'ultimo controllo, quello che resta umano, e cambia il modo in cui una risposta dell'AI diventa una tua decisione. In questo pezzo vediamo perche' un output convincente non e' un output verificato, cosa guardare davvero quando rilegghi, e perche' questo gesto e' un metodo, non una perdita di tempo — fino al punto in cui il discorso porta ad Arena.

Mixture of Experts: come un modello AI attiva solo gli esperti giusti
Per anni l'intuizione sui modelli AI e' stata semplice: piu' grande, piu' capace. Ma c'e' un costo nascosto, perche' ogni risposta accende l'intero modello anche per la domanda piu' banale. Il Mixture of Experts (una miscela di esperti) rompe questo legame: divide la conoscenza in tante sotto-reti specializzate e ne attiva solo alcune per volta, scelte da un router interno. Cosi' un modello puo' essere enorme nel sapere complessivo e leggero in cio' che usa a ogni risposta. Ma resta un solo modello, con una sola visione del problema: il router sceglie tra esperti che condividono lo stesso addestramento. Per le decisioni che contano il limite non e' l'efficienza, e' la prospettiva unica — ed e' il salto che porta ad Arena.

Ricerca semantica: come un'AI capisce il significato oltre le parole
Per decenni cercare ha voluto dire far combaciare parole: scrivi un termine, il sistema trova i documenti che contengono quello stesso termine. La ricerca semantica cambia le regole. Non insegue le parole, insegue il significato: capisce che una domanda posta in un modo e una risposta scritta in un altro possono parlare della stessa cosa anche senza condividere una sola parola. Dietro questo salto c'e' un modo diverso di rappresentare il linguaggio, che permette a un'AI di trovare cio' che intendi e non solo cio' che digiti. Capire come funziona aiuta a leggere meglio i sistemi che usiamo ogni giorno, e a capire perche' confrontare piu' prospettive resta il passo che conta.

Il prompt di sistema: cosa guida davvero un modello AI
Quando scrivi a un assistente AI non parti mai da una pagina bianca: prima della tua domanda, il modello ha gia' ricevuto un set di istruzioni che tu non vedi. Si chiama prompt di sistema, ed e' lo strato che decide chi e' il modello, come scrive e cosa puo' fare. Capirlo spiega perche' due AI, sulla stessa domanda, ti rispondono in modo cosi' diverso.

Tokenizzazione: come un modello AI legge davvero il testo
Quando leggi una frase la spezzi in parole senza accorgertene, e su quei pezzi costruisci il senso. Un modello AI fa qualcosa di simile prima ancora di 'capire' qualsiasi cosa, ma i pezzi in cui divide il testo non sono le nostre parole: sono token, frammenti che possono valere una parola intera o solo un pezzo di essa. Quel primo taglio ha un nome, tokenizzazione (tokenization), ed e' il gesto invisibile da cui dipende tutto quello che il modello fara' dopo: quanto costa una risposta, quanto testo riesce a tenere insieme, dove inciampa. Capire come un modello divide il testo aiuta a smontare l'idea che 'legga' come noi, e mostra perche' un solo modo di tagliare e' anche un solo punto di vista. Da qui nasce il valore di mettere piu' prospettive a confronto.

Attenzione: come un modello AI decide cosa conta in una frase
Quando leggi una frase non dai lo stesso peso a ogni parola: alcune le lasci scivolare, su altre ti fermi, e capisci il senso proprio da come le colleghi tra loro. Un modello AI fa qualcosa di simile, e ha un nome preciso: attenzione (attention). E' il meccanismo che gli permette, mentre elabora un testo, di stabilire quali parole contano di piu' per interpretare le altre, e di tenere insieme il significato invece di leggere parola per parola in modo piatto. Capire questa idea aiuta a smontare un equivoco diffuso, e cioe' che il modello 'legga' come noi. Non legge: pesa. E il modo in cui pesa le parole e' anche il suo limite piu' profondo, perche' e' un solo modo di decidere cosa conta. Da qui parte il valore di mettere piu' prospettive a confronto invece di fidarsi di una lettura sola.

Embedding: come un modello AI organizza il significato
Quando scrivi una frase a un sistema AI, prima ancora che risponda succede qualcosa di invisibile: le tue parole vengono trasformate in numeri, in coordinate dentro uno spazio. Questo passaggio ha un nome, embedding, ed e' uno dei mattoni su cui poggia quasi tutto quello che l'AI sa fare oggi, dalla ricerca per significato alla capacita' di collegare idee lontane. Non e' un dettaglio da addetti ai lavori: capire, a grandi linee, come un modello dispone i concetti in questo spazio aiuta a capire perche' certe cose gli riescono benissimo e altre lo tradiscono. Il modello non conosce il mondo come lo conosci tu, ma ha una mappa del significato, e quella mappa spiega molto del suo comportamento. Vale la pena guardarci dentro, senza tecnicismi, per usare l'AI con piu' consapevolezza.

Temperatura: perche' la stessa domanda all'AI da' risposte diverse
Fai la stessa domanda a un sistema AI due volte e puoi ricevere due risposte diverse. Non e' un errore ne' un capriccio: e' una scelta di progetto, governata da un parametro chiamato temperatura. La temperatura regola quanta liberta' il modello si concede nello scegliere la parola successiva: bassa e le risposte diventano prevedibili e ripetibili, alta e diventano varie e creative ma meno stabili. Capire questo parametro spiega di colpo tante cose che sembrano bizzarre: perche' un modello a volte inventa, perche' due tentativi non coincidono, perche' la stessa richiesta rende meglio in un momento e peggio in un altro. Non e' un dettaglio da tecnici: e' la ragione per cui non puoi giudicare un sistema AI da una sola risposta, e per cui il confronto tra piu' prospettive conta piu' del singolo tentativo fortunato.

Il limite della conoscenza: cosa un modello AI non puo' sapere
Ogni modello AI ha un confine invisibile oltre il quale non ha imparato nulla: la data fino a cui e' stato addestrato, il cosiddetto limite della conoscenza (knowledge cutoff). Tutto quello che e' successo dopo quella data, per il modello, semplicemente non esiste. E accanto a questo confine temporale ce ne sono altri due, ancora piu' insidiosi: il modello non conosce il tuo contesto privato e non sa cosa non sa. Il risultato e' un sistema capace di scrivere con la stessa sicurezza sia cio' che ha imparato bene sia cio' che ignora del tutto. Capire dove passano questi confini non e' un dettaglio tecnico: e' la differenza tra usare un modello con cognizione di causa e fidarsi alla cieca di una risposta che suona giusta ma poggia sul vuoto.

Multimodalita': quando l'AI unisce testo, immagini e voce
Per anni l'AI e' stata soprattutto una questione di testo: scrivevi, leggeva, ti rispondeva. La multimodalita' (multimodality) rompe questo confine: un modello che tratta insieme parole, immagini, audio e voce, avvicinandosi al modo in cui noi percepiamo davvero il mondo. E' un salto tecnologico concreto, che cambia i flussi di lavoro e apre usi impensabili fino a poco fa. Ma piu' un modello unisce i sensi, piu' e' facile dimenticare un limite che resta: anche il modello piu' completo ti offre comunque una sola prospettiva sul problema. Capire cosa cambia con la multimodalita' e cosa invece non cambia e' il modo giusto per usarla senza illudersi.

La finestra di contesto: cosa puo' davvero vedere un modello AI
Quando scrivi a un'AI immagini che ti stia ascoltando come farebbe una persona, con tutta la conversazione ben presente. In realta' ogni modello lavora dentro una finestra di contesto: uno spazio limitato che contiene cio' che puo' considerare in quel momento. Tutto quello che sta dentro la finestra il modello lo vede; tutto quello che ne resta fuori, per lui semplicemente non esiste. Capire come funziona questo spazio cambia il modo in cui usi lo strumento: spiega perche' a volte sembra dimenticare, perche' una finestra piu' grande non equivale a piu' comprensione, e perche' cio' che scegli di metterci dentro conta piu' della sua dimensione.

Ragionamento dell'AI: cosa succede quando il modello 'pensa' a voce
I sistemi AI piu' recenti hanno imparato a non consegnare solo la conclusione, ma a mostrare il percorso che porta alla risposta: il ragionamento a catena (chain-of-thought). Esporre i passaggi intermedi spesso migliora la qualita' su problemi complessi e rende il percorso controllabile, ma quei passaggi restano testo generato, non un registro garantito di cio' che accade dentro il modello. Capire la differenza tra ragionamento come processo e ragionamento come spiegazione e' la chiave per fidarsi degli output al punto giusto. E quando i ragionamenti si possono confrontare, smettono di essere un monologo da accettare e diventano materiale da esaminare.

Allucinazioni dell'AI: perche' accadono e come il confronto le smaschera
Capita a chiunque usi un sistema AI: a un certo punto la risposta suona perfetta, sicura, ben scritta, e proprio per questo te ne fidi. Poi scopri che il dato non esiste o la citazione e' inventata. E' il fenomeno che chiamiamo allucinazione, e non e' un guasto occasionale: e' una caratteristica strutturale di come queste tecnologie sono fatte. Capire perche' accade e' il primo passo per non farsi ingannare, e mettere a confronto piu' prospettive complementari e' il modo piu' robusto per renderla visibile prima che diventi una decisione sbagliata.

Modelli specializzati o generalisti: il falso dilemma dell'AI
Per scegliere uno strumento AI ci si chiede spesso se convenga un modello generalista, capace di un po' di tutto, o uno specialista, addestrato a fondo su un singolo dominio. E' una domanda che sembra tecnica ma decide la qualita' del lavoro di ogni giorno: ampiezza contro profondita', con i suoi compromessi nascosti. E forse, oggi, e' la domanda sbagliata.

Quando le AI non sono d'accordo: il disaccordo e' un segnale
Quando piu' modelli AI divergono sullo stesso problema, la divergenza non e' un guasto da appianare: e' un'informazione sul fatto che il terreno e' incerto o conteso. Chi usa una sola AI perde questo segnale. Chi confronta prospettive complementari trasforma il disaccordo in decisioni piu' consapevoli e meno fragili.

Sycophancy: perche' i modelli generativi tendono a compiacere l'utente
La sycophancy, ovvero la tendenza dei modelli AI a compiacere l'utente, non e' un difetto morale. E' un effetto strutturale di come vengono addestrati. Riconoscerla e' il primo passo per non confondere il rinforzo emotivo con la qualita' di una risposta.
Tutti i temi