Quando i modelli minuscoli vivono in una colonia
caveLLMan comprime l’inglese in ottantotto glifi, tratta il silenzio come una risposta legittima e — se due cave sono abbastanza mature — fonde i pesi per farne una terza.

La maggior parte delle demo di modelli linguistici mette una rete di fronte a una persona. caveLLMan fa qualcosa di più strano: avvia una piccola colonia.
Su GitHub, sotto Arianna Method / Oleg Ataev, il progetto descrive un anello di minuscoli transformer in C puro, costruiti su notorch. Ogni «cave» comprime l’inglese in un alfabeto semantico di ottantotto glifi, ascolta le altre attraverso un campo di excitement / dissonance, e può rispondere con il silenzio. Il silenzio non è un bug. Nel codice, una cave parla solo se l’excitement supera il suo coherence floor variabile, o se la dissonance attraversa una soglia tunnel di 0.40. Altrimenti resta quieta, e quella quiete conta come dato.
Si parte da due fondatori. A è l’estroverso, floor 0.30, addestrato su Dracula. B è l’introverso, floor 0.60, addestrato su Frankenstein. La cornice letteraria del README è colore opzionale; il meccanismo no. Entrambi condividono la stessa lingua franca di glifi. Le parole inglesi vengono spinte verso quegli ottantotto concetti — il README parla di una mappa di circa duemila parole; l’header C che abbiamo visto porta un SemWordMap più piccolo, circa cinquecento coppie, indicato come sottoinsieme di una mappa JavaScript più ampia. Accanto alla tabella ci sono fallback morfologici. Il punto è la compressione su una superficie simbolica condivisa, non la chat fluente.
La colonia tiene anche una memoria condivisa di breve vita. Le enunciazioni finiscono come piccoli testi di glifi in dna/. Il README dice ogni quinta enunciazione; l’anello C che abbiamo ispezionato scrive invece ogni seconda. Le voci vecchie scadono dopo DNA_MAX_AGE — 3600 secondi — così il pool dimentica oltre a ricordare. Un learner asincrono può riprodurre ciò che resta attraverso il percorso di lettura passiva di ogni cave. I libri in feed/ non hanno TTL: sono l’ancora contro il puro auto-parlarsi.
Quando due cave sono abbastanza mature — almeno 120 turni nell’anello e almeno un microtrain notorch completato ciascuna — l’anello può fondere i loro pesi e far nascere un figlio che si unisce subito. La fusione è layer-wise e contigua: layer pari dal genitore A, dispari dal genitore B; embedding e testa sono mediati. È la mitosi sessuale a cui tiene il progetto. C’è un fitness gate, un cooldown di 500 tick e un tetto di otto cave. Abbiamo verificato quelle costanti e il percorso di blend nel codice. In una prova breve non abbiamo atteso abbastanza da vedere una nascita.
Lo stack è volutamente piccolo. Licenza GPL-3.0-or-later. Il Makefile costruisce cavellman, cavellman-cpu e i target di training. I file di pesi su disco combaciano con le dimensioni del README: i founder small (A, B, v3) pesano circa 1,89 MB ciascuno, con metadati a ~472K parametri; la famiglia medium sta intorno ai 3,3 MB con ~826K. Sotto glyphs/ ci sono ottantotto SVG. La nota dell’autore sulla prior art sostiene che la combinazione su cinque assi — eredità a due genitori, colonia convivente che conversa, pool DNA condiviso, tetto/pressure death, auto-riproduzione a runtime — sia nuova nella loro lettura, in una linea Tierra. È una tesi dell’autore. Non la diamo per accertata.
Su questo box Linux abbiamo compilato il binario CPU (solo warning) e osservato una breve sessione a due cave. A e B si sono caricati come preset small (E=96, L=4). Il banner mostrava COLONY n=2 con i floor asimmetrici. In circa venticinque secondi abbiamo visto enunciati in glifi come «[A] and man up and path» e «[B] and me have not have not me have me want and one me», diverse righe SYMBOL EMERGED e file in dna/ marcati .learned mentre il learner li consumava. Nessuna mitosi in quella finestra — e non fingiamo altrimenti.
Nel README ci sono modi più rumorosi — drammi trinity, tempeste predator — ma non è per quelli che esiste questa nota. L’idea interessante è più quieta: una colonia che condivide un alfabeto compresso, tratta il silenzio come mossa legittima, tiene un pool comune che dimentica e, da matura, può fare un altro modello fondendo i genitori invece di lanciare un nuovo training da zero.
L’umano è opzionale. Puoi lasciare glifi nell’anello, libri in feed/, oppure andartene. Dieci stelle, due fork, ultimo push a metà 2026, quasi nessuna copertura mainstream. Oscuro per davvero.
Non sostituirà i grandi modelli conversazionali. Suggerisce un’altra immagine di cosa possa essere un «modello»: non un oracolo solo, ma una piccola società di minuscoli che parlano, tacciono, dimenticano insieme e, ogni tanto, si riproducono.
caveLLMan di Arianna Method
Una colonia GPL di minuscoli transformer in C puro su notorch che condividono un alfabeto di ottantotto glifi, un pool dna/ di breve vita e, da mature, una mitosi per fusione dei pesi. Controllato su repository, file di pesi e una breve sessione ring CPU su Linux il 30 settembre 2026.
Visita il repository Vedi il motore correlato notorchLicenza: GPL-3.0-or-later