Zatímco globální závody v oblasti umělé inteligence dlouhodobě ovládají američtí a čínští giganti, Evropa se znovu hlásí o slovo. Německý AI startup Aleph Alpha představil nový otevřený model s názvem Kolibri.

Pokud ale čekáte dalšího konverzačního asistenta, který vám nahradí ChatGPT nebo Gemini při každodenním psaní e-mailů či plánování dovolené, budete zklamaní. Kolibri vůbec míří na zcela jinou cílovou skupinu – na státní správu, zdravotnictví, bankovnictví a průmysl.

Co je Kolibri a v čem se liší od ChatGPT?

Model Kolibri (se 78 miliardami parametrů, z nichž je 3,46 miliardy aktivních v rámci architektury Mixture-of-Experts a s kontextovým oknem až 1 milion tokenů) byl od prvního dne navrhován jako nástroj zaměřený na digitální suverenitu.

Na rozdíl od běžných cloudových služeb, u nichž jsou citlivá data odesílána na servery amerických firem, je Kolibri plně k dispozici pod licencí Apache 2.0. Firmy i úřady si tak mohou model volně stáhnout (např. z platformy Hugging Face) a provozovat jej lokálně na vlastní infrastruktuře.

Hlavní přínosy modelu Kolibri:

  • Kompletní kontrola nad daty: Citlivé interní dokumenty, lékařské záznamy či bankovní data nikdy neopustí vaši vlastní síť.
  • Nulové licenční poplatky: Model je volně dostupný zdarma, jediným nákladem je vlastní výpočetní hardware.
  • Práce s rozsáhlými dokumenty: Vhodný pro analýzu tisíců stran právních předpisů, technických výkresů, interních směrnic a audity dodržování předpisů (compliance).

Boj s halucinacemi: Když AI raději přizná, že neví

Jedním z největších rizik generativní AI v úředním či průmyslovém prostředí je tzv. halucinování – tedy stav, kdy si AI model vymýšlí přesvědčivě znějící, avšak zcela chybné informace.

Pro Aleph Alpha byla eliminace halucinací klíčovou prioritou. Kolibri byl trénován tak, aby v případě nedostatečných podkladů raději otevřeně přiznal, že odpověď nezná, než aby si vymýšlel. Při interních testech zacílených na potlačení halucinací model vymýšlení odmítl až ve 44 % případů, kdy neměl k dispozici dostatek ověřených faktů.

Němčina bez překladového zkreslení

Zvláštní pozornost věnovali vývojáři z Heidelbergu také jazykovému přizpůsobení. Zatímco většina velkých jazykových modelů vzniká primárně v angličtině a pro jiné jazyky se spoléhá na překlady či dodatečné dolaďování, Kolibri byl od začátku budován jako bilingvní anglicko-německý model. Němčina tvořila přibližně 20 % všech trénovacích dat.

Vývojáři navíc upravili datové filtry. Běžné anglické algoritmy totiž často odstraňují texty obsahující příliš dlouhá slova, což v německé úřední mluvě vedlo k nechtěnému mazání důležitých státních a právních dokumentů.

       [ Tradiční cloudová AI ]             [ Model Kolibri (Aleph Alpha) ]
Datový tok: Uživatel ➔ Cloud v USA       Datový tok: Uživatel ➔ Vlastní server (On-premise)
Bezpečnost: Riziko úniku dat             Bezpečnost: Plná datová suverenita
Licence:    Předplatné / API poplatky    Licence:    Open-source (Apache 2.0)

Výkon v benchmarkách vs. reálná hodnota pro Evropu

Pokud jde o čistý výpočetní výkon a skóre v tradičních žebříčcích, Kolibri za nejšpičkovějšími globálními modely mírně zaostává. Jeho síla však spočívá v něčem jiném.

Aleph Alpha, podporovaná významnými evropskými průmyslovými hráči (mezi něž patří například i skupina Schwarz Group provozující řetězce Lidl a Kaufland), tímto krokem pokládá základní kámen pro nezávislou evropskou AI infrastrukturu.

Závěr

Německý model Kolibri ukazuje, že Evropa nemusí přímo soupeřit v závodu o nejchytřejšího univerzálního chatbota pro veřejnost. Místo toho sází na bezpečnost, dodržování regulací a datovou nezávislost – tedy hodnoty, které jsou pro evropský průmysl a státní správu naprosto klíčové. Myslíte si, že je strategie vlastní lokální AI správnou cestou pro evropské firmy?

Komentáre

Napsat komentář

Vaše e-mailová adresa nebude zveřejněna. Vyžadované informace jsou označeny *

Přihlásit

Registrovat

Obnova hesla

Zadejte uživatelské jméno nebo e-mailovou adresu, e-mailem obdržíte odkaz pro vytvoření nového hesla.