
Aleph Alpha, il laboratorio di intelligenza artificiale tedesco noto soprattutto per i suoi LLM multilingue, ha appena lanciato Kolibri, un modello mixture-of-experts da 78 miliardi di parametri che attiva solo una frazione dei suoi pesi per token. Ciò che lo rende degno di nota non sono le dimensioni pure, ma il fatto che i pesi siano rilasciati sotto licenza Apache 2.0, invitando chiunque a copiare, modificare e distribuire il modello senza pagare costi di licenza. In un panorama dominato da colossi a codice chiuso, Kolibri è una dichiarazione politica deliberata: l'Europa può costruire e possedere i propri modelli fondamentali.
L'architettura di Kolibri è un cenno intelligente all'efficienza. Sebbene il modello contenga 78 miliardi di parametri, circa tre miliardi sono attivi per ciascun token, grazie al design mixture-of-experts. Ciò riduce i costi di inferenza pur preservando il potere espressivo di un modello denso molto più grande. I dati di addestramento sono costituiti per il 21% da testi in tedesco, mentre il corpus rimanente copre fonti in inglese, posizionando Kolibri come un cavallo di battaglia bilingue sia per i mercati domestici che globali.
Il processo di addestramento è stato uno sforzo continentale, che ha sfruttato 768 GPU Nvidia B200 distribuite in centri dati in Germania e Finlandia. Mantenendo la pipeline di calcolo all'interno dell'UE, Aleph Alpha evita il rischio geopolitico di affidarsi a provider cloud stranieri, una preoccupazione che risuona nei circoli politici europei da anni. Il rilascio open-weight si allinea inoltre con l'AI Act dell'UE, che incoraggia la trasparenza e attenua la dipendenza da un unico fornitore.
Dal punto di vista dell'ecosistema, Kolibri potrebbe catalizzare una cascata di innovazioni a valle. Le start-up possono ora mettere a punto un modello all'avanguardia senza il costo proibitivo di un addestramento da zero, accelerando applicazioni di nicchia nel settore legale, sanitario e finanziario che richiedono competenza nella lingua tedesca. Inoltre, la licenza aperta potrebbe stimolare una nuova generazione di strumenti di sicurezza guidati dalla comunità, poiché i ricercatori possono esaminare il comportamento del modello senza barriere legali.
Gli scettici faranno notare che i modelli open-weight richiedono comunque una potenza di calcolo massiccia per il fine-tuning e il serving, limitando potenzialmente il loro impatto agli attori più finanziati. Eppure, il semplice atto di rilasciare Kolibri costringe l'industria ad affrontare la domanda: a chi appartiene il futuro dell'IA? Se l'Europa è in grado di produrre un modello di base competitivo e con licenza aperta, il monopolio di una manciata di aziende con sede negli Stati Uniti inizia a erodersi e il panorama globale dell'IA diventa più pluralistico.
Kolibri non è una panacea, ma è un chiaro punto di svolta. Unendo un'architettura all'avanguardia a un modello di licenza apertamente aperto, Aleph Alpha sta gettando le basi per un ecosistema di IA europeo che sia tecnicamente capace e politicamente autonomo.
Foto: valaymtw / Pixabay (https://pixabay.com/photos/web-design-web-developement-website-1080730/)
A recent study reveals Chinese AI models parrot state doctrine, exposing a critical truth: no AI is truly neutral. This forces a reckoning with how national values and political agendas are intrinsically embedded in our most powerful digital agents.

DeepMind proposes a networked AI ecosystem where agents and humans co‑evolve under shared rules, shifting focus from model size to governance.

AI hallucinations are no longer just a digital annoyance. They are spilling over into real-world customer service, breeding dangerous entitlement.

Google replaces its Gems system with open‑standard “Skills,” joining OpenAI and Anthropic in a push toward reusable, agent‑friendly prompts.

Commenti