Tutti gli articoli

    Tag

    Come funziona un LLM

    Token, embedding, attenzione: cosa succede davvero dentro un modello linguistico.

    17 · Articoli su questo tema

    I parametri di un modello: cosa significano davvero i miliardi
    Tecnologia

    I parametri di un modello: cosa significano davvero i miliardi

    Quando si parla di un modello AI arriva sempre il numero: sette miliardi di parametri, settanta, centinaia. Il numero fa notizia perche' e' grande, e la scorciatoia mentale e' immediata: piu' parametri, modello migliore. E' una lettura comoda e quasi sempre fuorviante. In questo pezzo vediamo cosa sia davvero un parametro, perche' la dimensione dice molto meno di quanto sembri, dove il conteggio conta per davvero e dove invece e' quasi inutile per chi usa l'AI per decidere e lavorare — fino al punto in cui la vera domanda non e' piu' quanto e' grande un modello, ma quale prospettiva ti serve su un problema, ed e' li' che il discorso porta ad Arena.

    6 min di letturaLeggi articolo
    Rileggere l'output prima di usarlo: l'ultimo controllo resta umano
    Metodo

    Rileggere l'output prima di usarlo: l'ultimo controllo resta umano

    Un modello AI restituisce testi puliti, sicuri, ben scritti — ed e' proprio questa scorrevolezza il punto piu' insidioso: un output che suona bene sembra gia' pronto, e la tentazione di copiarlo e incollarlo senza rileggerlo e' forte. Ma la qualita' della forma non e' la qualita' del contenuto. Rileggere prima di usare non e' un passaggio burocratico ne' un segno di sfiducia verso lo strumento: e' l'ultimo controllo, quello che resta umano, e cambia il modo in cui una risposta dell'AI diventa una tua decisione. In questo pezzo vediamo perche' un output convincente non e' un output verificato, cosa guardare davvero quando rilegghi, e perche' questo gesto e' un metodo, non una perdita di tempo — fino al punto in cui il discorso porta ad Arena.

    6 min di letturaLeggi articolo
    Mixture of Experts: come un modello AI attiva solo gli esperti giusti
    Tecnologia

    Mixture of Experts: come un modello AI attiva solo gli esperti giusti

    Per anni l'intuizione sui modelli AI e' stata semplice: piu' grande, piu' capace. Ma c'e' un costo nascosto, perche' ogni risposta accende l'intero modello anche per la domanda piu' banale. Il Mixture of Experts (una miscela di esperti) rompe questo legame: divide la conoscenza in tante sotto-reti specializzate e ne attiva solo alcune per volta, scelte da un router interno. Cosi' un modello puo' essere enorme nel sapere complessivo e leggero in cio' che usa a ogni risposta. Ma resta un solo modello, con una sola visione del problema: il router sceglie tra esperti che condividono lo stesso addestramento. Per le decisioni che contano il limite non e' l'efficienza, e' la prospettiva unica — ed e' il salto che porta ad Arena.

    6 min di letturaLeggi articolo
    Ricerca semantica: come un'AI capisce il significato oltre le parole
    Tecnologia

    Ricerca semantica: come un'AI capisce il significato oltre le parole

    Per decenni cercare ha voluto dire far combaciare parole: scrivi un termine, il sistema trova i documenti che contengono quello stesso termine. La ricerca semantica cambia le regole. Non insegue le parole, insegue il significato: capisce che una domanda posta in un modo e una risposta scritta in un altro possono parlare della stessa cosa anche senza condividere una sola parola. Dietro questo salto c'e' un modo diverso di rappresentare il linguaggio, che permette a un'AI di trovare cio' che intendi e non solo cio' che digiti. Capire come funziona aiuta a leggere meglio i sistemi che usiamo ogni giorno, e a capire perche' confrontare piu' prospettive resta il passo che conta.

    6 min di letturaLeggi articolo
    Il prompt di sistema: cosa guida davvero un modello AI
    Tecnologia

    Il prompt di sistema: cosa guida davvero un modello AI

    Quando scrivi a un assistente AI non parti mai da una pagina bianca: prima della tua domanda, il modello ha gia' ricevuto un set di istruzioni che tu non vedi. Si chiama prompt di sistema, ed e' lo strato che decide chi e' il modello, come scrive e cosa puo' fare. Capirlo spiega perche' due AI, sulla stessa domanda, ti rispondono in modo cosi' diverso.

    6 min di letturaLeggi articolo
    Tokenizzazione: come un modello AI legge davvero il testo
    Tecnologia

    Tokenizzazione: come un modello AI legge davvero il testo

    Quando leggi una frase la spezzi in parole senza accorgertene, e su quei pezzi costruisci il senso. Un modello AI fa qualcosa di simile prima ancora di 'capire' qualsiasi cosa, ma i pezzi in cui divide il testo non sono le nostre parole: sono token, frammenti che possono valere una parola intera o solo un pezzo di essa. Quel primo taglio ha un nome, tokenizzazione (tokenization), ed e' il gesto invisibile da cui dipende tutto quello che il modello fara' dopo: quanto costa una risposta, quanto testo riesce a tenere insieme, dove inciampa. Capire come un modello divide il testo aiuta a smontare l'idea che 'legga' come noi, e mostra perche' un solo modo di tagliare e' anche un solo punto di vista. Da qui nasce il valore di mettere piu' prospettive a confronto.

    6 min di letturaLeggi articolo
    Attenzione: come un modello AI decide cosa conta in una frase
    Tecnologia

    Attenzione: come un modello AI decide cosa conta in una frase

    Quando leggi una frase non dai lo stesso peso a ogni parola: alcune le lasci scivolare, su altre ti fermi, e capisci il senso proprio da come le colleghi tra loro. Un modello AI fa qualcosa di simile, e ha un nome preciso: attenzione (attention). E' il meccanismo che gli permette, mentre elabora un testo, di stabilire quali parole contano di piu' per interpretare le altre, e di tenere insieme il significato invece di leggere parola per parola in modo piatto. Capire questa idea aiuta a smontare un equivoco diffuso, e cioe' che il modello 'legga' come noi. Non legge: pesa. E il modo in cui pesa le parole e' anche il suo limite piu' profondo, perche' e' un solo modo di decidere cosa conta. Da qui parte il valore di mettere piu' prospettive a confronto invece di fidarsi di una lettura sola.

    6 min di letturaLeggi articolo
    Embedding: come un modello AI organizza il significato
    Tecnologia

    Embedding: come un modello AI organizza il significato

    Quando scrivi una frase a un sistema AI, prima ancora che risponda succede qualcosa di invisibile: le tue parole vengono trasformate in numeri, in coordinate dentro uno spazio. Questo passaggio ha un nome, embedding, ed e' uno dei mattoni su cui poggia quasi tutto quello che l'AI sa fare oggi, dalla ricerca per significato alla capacita' di collegare idee lontane. Non e' un dettaglio da addetti ai lavori: capire, a grandi linee, come un modello dispone i concetti in questo spazio aiuta a capire perche' certe cose gli riescono benissimo e altre lo tradiscono. Il modello non conosce il mondo come lo conosci tu, ma ha una mappa del significato, e quella mappa spiega molto del suo comportamento. Vale la pena guardarci dentro, senza tecnicismi, per usare l'AI con piu' consapevolezza.

    6 min di letturaLeggi articolo
    Temperatura: perche' la stessa domanda all'AI da' risposte diverse
    Tecnologia

    Temperatura: perche' la stessa domanda all'AI da' risposte diverse

    Fai la stessa domanda a un sistema AI due volte e puoi ricevere due risposte diverse. Non e' un errore ne' un capriccio: e' una scelta di progetto, governata da un parametro chiamato temperatura. La temperatura regola quanta liberta' il modello si concede nello scegliere la parola successiva: bassa e le risposte diventano prevedibili e ripetibili, alta e diventano varie e creative ma meno stabili. Capire questo parametro spiega di colpo tante cose che sembrano bizzarre: perche' un modello a volte inventa, perche' due tentativi non coincidono, perche' la stessa richiesta rende meglio in un momento e peggio in un altro. Non e' un dettaglio da tecnici: e' la ragione per cui non puoi giudicare un sistema AI da una sola risposta, e per cui il confronto tra piu' prospettive conta piu' del singolo tentativo fortunato.

    6 min di letturaLeggi articolo
    Il limite della conoscenza: cosa un modello AI non puo' sapere
    Tecnologia

    Il limite della conoscenza: cosa un modello AI non puo' sapere

    Ogni modello AI ha un confine invisibile oltre il quale non ha imparato nulla: la data fino a cui e' stato addestrato, il cosiddetto limite della conoscenza (knowledge cutoff). Tutto quello che e' successo dopo quella data, per il modello, semplicemente non esiste. E accanto a questo confine temporale ce ne sono altri due, ancora piu' insidiosi: il modello non conosce il tuo contesto privato e non sa cosa non sa. Il risultato e' un sistema capace di scrivere con la stessa sicurezza sia cio' che ha imparato bene sia cio' che ignora del tutto. Capire dove passano questi confini non e' un dettaglio tecnico: e' la differenza tra usare un modello con cognizione di causa e fidarsi alla cieca di una risposta che suona giusta ma poggia sul vuoto.

    6 min di letturaLeggi articolo
    Multimodalita': quando l'AI unisce testo, immagini e voce
    Tecnologia

    Multimodalita': quando l'AI unisce testo, immagini e voce

    Per anni l'AI e' stata soprattutto una questione di testo: scrivevi, leggeva, ti rispondeva. La multimodalita' (multimodality) rompe questo confine: un modello che tratta insieme parole, immagini, audio e voce, avvicinandosi al modo in cui noi percepiamo davvero il mondo. E' un salto tecnologico concreto, che cambia i flussi di lavoro e apre usi impensabili fino a poco fa. Ma piu' un modello unisce i sensi, piu' e' facile dimenticare un limite che resta: anche il modello piu' completo ti offre comunque una sola prospettiva sul problema. Capire cosa cambia con la multimodalita' e cosa invece non cambia e' il modo giusto per usarla senza illudersi.

    6 min di letturaLeggi articolo
    La finestra di contesto: cosa puo' davvero vedere un modello AI
    Tecnologia

    La finestra di contesto: cosa puo' davvero vedere un modello AI

    Quando scrivi a un'AI immagini che ti stia ascoltando come farebbe una persona, con tutta la conversazione ben presente. In realta' ogni modello lavora dentro una finestra di contesto: uno spazio limitato che contiene cio' che puo' considerare in quel momento. Tutto quello che sta dentro la finestra il modello lo vede; tutto quello che ne resta fuori, per lui semplicemente non esiste. Capire come funziona questo spazio cambia il modo in cui usi lo strumento: spiega perche' a volte sembra dimenticare, perche' una finestra piu' grande non equivale a piu' comprensione, e perche' cio' che scegli di metterci dentro conta piu' della sua dimensione.

    6 min di letturaLeggi articolo
    Ragionamento dell'AI: cosa succede quando il modello 'pensa' a voce
    Tecnologia

    Ragionamento dell'AI: cosa succede quando il modello 'pensa' a voce

    I sistemi AI piu' recenti hanno imparato a non consegnare solo la conclusione, ma a mostrare il percorso che porta alla risposta: il ragionamento a catena (chain-of-thought). Esporre i passaggi intermedi spesso migliora la qualita' su problemi complessi e rende il percorso controllabile, ma quei passaggi restano testo generato, non un registro garantito di cio' che accade dentro il modello. Capire la differenza tra ragionamento come processo e ragionamento come spiegazione e' la chiave per fidarsi degli output al punto giusto. E quando i ragionamenti si possono confrontare, smettono di essere un monologo da accettare e diventano materiale da esaminare.

    6 min di letturaLeggi articolo
    Allucinazioni dell'AI: perche' accadono e come il confronto le smaschera
    Tecnologia

    Allucinazioni dell'AI: perche' accadono e come il confronto le smaschera

    Capita a chiunque usi un sistema AI: a un certo punto la risposta suona perfetta, sicura, ben scritta, e proprio per questo te ne fidi. Poi scopri che il dato non esiste o la citazione e' inventata. E' il fenomeno che chiamiamo allucinazione, e non e' un guasto occasionale: e' una caratteristica strutturale di come queste tecnologie sono fatte. Capire perche' accade e' il primo passo per non farsi ingannare, e mettere a confronto piu' prospettive complementari e' il modo piu' robusto per renderla visibile prima che diventi una decisione sbagliata.

    6 min di letturaLeggi articolo
    Modelli specializzati o generalisti: il falso dilemma dell'AI
    Tecnologia

    Modelli specializzati o generalisti: il falso dilemma dell'AI

    Per scegliere uno strumento AI ci si chiede spesso se convenga un modello generalista, capace di un po' di tutto, o uno specialista, addestrato a fondo su un singolo dominio. E' una domanda che sembra tecnica ma decide la qualita' del lavoro di ogni giorno: ampiezza contro profondita', con i suoi compromessi nascosti. E forse, oggi, e' la domanda sbagliata.

    6 min di letturaLeggi articolo
    Quando le AI non sono d'accordo: il disaccordo e' un segnale
    Metodo

    Quando le AI non sono d'accordo: il disaccordo e' un segnale

    Quando piu' modelli AI divergono sullo stesso problema, la divergenza non e' un guasto da appianare: e' un'informazione sul fatto che il terreno e' incerto o conteso. Chi usa una sola AI perde questo segnale. Chi confronta prospettive complementari trasforma il disaccordo in decisioni piu' consapevoli e meno fragili.

    6 min di letturaLeggi articolo
    Sycophancy: perche' i modelli generativi tendono a compiacere l'utente
    TechNews

    Sycophancy: perche' i modelli generativi tendono a compiacere l'utente

    La sycophancy, ovvero la tendenza dei modelli AI a compiacere l'utente, non e' un difetto morale. E' un effetto strutturale di come vengono addestrati. Riconoscerla e' il primo passo per non confondere il rinforzo emotivo con la qualita' di una risposta.

    9 min di letturaLeggi articolo

    Tutti i temi