lf.Un taccuino indipendenteEnglish
Dal taccuino / 003liminalfinds.it

Ho trovato un’AI che non vuole parlare. Vuole solo decidere.

Laya è un piccolo modello aperto costruito per scegliere, valutare e classificare invece di generare frasi. Forse la parte interessante è proprio il suo limite.

Oggi tendiamo a giudicare un’AI soprattutto da quanto bene sa parlare.

Le chiediamo di spiegare, scrivere, riassumere, ragionare ad alta voce e trasformiamo quasi ogni problema in una conversazione.

Laya prende una strada stranamente diversa. Non prova nemmeno a rispondere in prosa.

Gli dai un testo o dei dati e alcune domande: quale reparto deve gestire questa mail, quanto è urgente, sembra phishing, quale opzione è la più adatta. Laya restituisce una scelta, un punteggio o una probabilità.

A prima vista sembra quasi un passo indietro. Abbiamo passato anni a rendere i modelli più generali, più eloquenti e capaci di fare un po’ di tutto.

Eppure una quantità sorprendente del lavoro che avviene dentro un software non è affatto una conversazione. È una decisione.

Smista questa richiesta. Segnala quel messaggio. Scegli una delle quattro azioni disponibili. Decidi se serve una persona. Stima quanto un testo appartiene a una certa categoria.

Usare un grande modello linguistico per compiti del genere può voler dire chiedere a una macchina molto potente di generare una piccola risposta invisibile, per poi sperare che il software intorno riesca a interpretarla correttamente.

Laya salta proprio la parte in cui l’AI parla.

Il progetto è pubblicato con licenza Apache 2.0 e offre diversi modelli. Quello inglese principale ha circa 421 milioni di parametri; la versione multilingue ne ha circa 322 milioni e copre più di 100 lingue. Possono girare sul proprio hardware senza dipendere obbligatoriamente da un’API cloud.

Soprattutto, il modello non genera token di risposta uno dopo l’altro. Valuta direttamente le possibili decisioni in un singolo passaggio.

C’è però un limite importante. Laya non è un piccolo giudice universale capace di sostituire magicamente un modello più grande. I risultati pubblicati dal progetto mostrano che i modelli generali possono essere deboli su compiti per cui non sono stati specializzati, e la documentazione invita esplicitamente a testarli e adattarli al proprio caso d’uso.

Ed è proprio questo limite che trovo interessante.

L’idea non è che un modello da 322 milioni di parametri abbia improvvisamente battuto tutti i chatbot. È che forse alcuni lavori affidati oggi ai chatbot non avevano bisogno di un chatbot fin dall’inizio.

Continuiamo a spingere l’intelligenza artificiale verso un unico sistema enorme e generale che sappia parlare di qualunque cosa. Laya indica la direzione opposta: sistemi più piccoli, con un compito molto preciso, eseguiti localmente e capaci di restituire soltanto il tipo di risposta che il software richiede davvero.

Non sostituirà ChatGPT, Claude o Gemini. Non è quello il punto.

A volte l’AI giusta è quella che non ha quasi nulla da dire.

02 / La scoperta

Laya di Convai Innovations

Una famiglia di modelli decisionali aperti che restituisce scelte, punteggi e probabilità invece di generare testo.

Leggi la model card ufficiale

GitHub: huggingface/relore ↗

Licenza: Apache-2.0