Otwarty czy europejski? Cztery pytania przed wyborem modelu językowego: dostawca, dane, infrastruktura, język

Otwarty czy europejski? Cztery pytania, które warto zadać przed wyborem modelu językowego

Każdy model językowy jest dziś europejski. Wystarczy dopytać, by natknąć się na centrum danych we Frankfurcie prowadzone przez firmę z Seattle. Kto tej jesieni podejmuje decyzje dotyczące generatywnej AI, wszędzie słyszy te same trzy określenia: otwarty, europejski, suwerenny. Co te słowa znaczą? O tym decyduje sam dostawca. Raport niderlandzkiej organizacji badawczej TNO z sierpnia 2026 r. stawia obok nich wyraźną miarę [1, 2].

Dlaczego „otwarty” i „europejski” pojawiają się nagle wszędzie

TNO zbadała na zlecenie niderlandzkiego Ministerstwa Spraw Wewnętrznych (BZK), co „otwarty” i „europejski” naprawdę oznaczają w odniesieniu do modeli językowych [1, 2]. Powód jest geopolityczny. Niderlandzka Strategia Cyfryzacji wymaga większej kontroli nad zależnościami cyfrowymi. Modele językowe stanowią najnowszą warstwę łańcucha oprogramowania, który już w dużej mierze znajduje się poza Europą. Wniosek jest jednoznaczny. Nie istnieje jednoznaczna definicja „otwartego” modelu językowego, a „europejski” można rozumieć na co najmniej cztery sposoby [1]. Dostawcy zręcznie to wykorzystują [1]. TNO nazywa to „open-washingiem”, „Europe-washingiem” i „suwerenność-washingiem” i zaleca instytucjom publicznym ustalenie własnych definicji roboczych przed rozpoczęciem zamówień [1]. To znana scena w gminach i instytucjach publicznych. Kupujący pyta, czy model jest otwarty; dostawca kiwa głową. CISO pyta, gdzie są dane; cisza. Dzięki poniższym pytaniom to Państwo kierują tą rozmową.

Otwartość to spektrum, nie przełącznik

TNO rozróżnia pięć stopni otwartości, z których trzy są w praktyce powszechne [1]:

  • Model zamknięty: korzystają Państwo z niego wyłącznie przez API. Rozmiar, dane treningowe i przetwarzanie danych pozostają tajne (na przykład GPT od OpenAI) [1].
  • Model open-weight: otrzymują Państwo wagi modelu [1]. Można go samodzielnie uruchomić i dostroić, ale nie widać danych treningowych ani procesu (jak Llama i Mistral) [1].
  • Model w pełni otwarty: udostępnia także dane treningowe i kod źródłowy (jak szwajcarski Apertus) [1].

Kluczowy niuans tkwi w kategorii środkowej. Open-weight to to, czym w rzeczywistości jest większość „otwartych” modeli. Ma to wartość: można go hostować samodzielnie i zachować kontrolę nad danymi. Ale nadal nie wiadomo dokładnie, co jest w środku. Gdy dostawca nazywa swój model „open source”, prawie zawsze ma na myśli open-weight. Pytanie 1: jaki dokładnie stopień otwartości ma ten model i co mogę dzięki temu samodzielnie zweryfikować?

Europejski model językowy to cztery pytania, nie jedno pole do zaznaczenia

W raporcie TNO posługuje się tabelą oceny z czterema odrębnymi kryteriami [1]:

  1. Pochodzenie dostawcy: czy organizacja podlega jurysdykcji EOG, czy ustawodawstwu zagranicznemu, takiemu jak amerykański CLOUD Act [1]?
  2. Lokalizacja danych: gdzie dane są przechowywane i przetwarzane [1]?
  3. Infrastruktura: na jakim sprzęcie działa model [1]?
  4. Podstawa językowa: czy model został w sposób wykazany wytrenowany na językach europejskich, w tym na Państwa języku [1]?

Model europejskiej firmy w amerykańskiej chmurze nie jest suwerenny, stwierdza TNO wprost [1]. I odwrotnie: otwarty europejski model niczego nie gwarantuje, jeśli sprzęt pochodzi z USA [1]. Ponadto model to jeszcze nie aplikacja: chatbot, z którego Państwo korzystają, składa się z całego łańcucha [1]. Proszę więc zadać te cztery pytania całemu łańcuchowi. Gdzie ma siedzibę organizacja? Gdzie są dane? Gdzie to działa? Czy model celowo wytrenowano na Państwa języku, czy zna go przypadkiem? Dostawca, który daje jasność we wszystkich czterech punktach, to rzadkość. Dostawca, który waha się w jednym z nich, od razu pokazuje, gdzie leżą ryzyka.

Nasze własne wybory i ich ciemna strona

Opowieść o jasnych wyborach działa tylko wtedy, gdy sami wyłożymy karty na stół. Platforma AI IRIS firmy ASE Cloud Services działa na Mistral Small, modelu open-weight na licencji Apache 2.0 od francuskiej firmy. W czterech pytaniach TNO wypada to następująco: dostawca w EOG, przechowywanie danych w naszym własnym środowisku chmurowym w OVHcloud (Gravelines i Strasburg), infrastruktura w UE i trening na językach europejskich. Ale TNO wskazuje też ryzyka właśnie tego wyboru [1]. Mistral oferuje modele open-weight z ograniczonym wglądem w dane treningowe, a ponadto istnieje stałe ryzyko przejęcia przez inwestorów spoza Europy [1]. To ryzyko amortyzuje się w architekturze wokół modelu. Sam model został uczyniony wymiennym. Baza wiedzy klienta znajduje się w odizolowanej warstwie RAG, nie prowadzi się treningu na danych klientów, a wszystko opiera się na otwartych standardach. Po zmianie modelu baza wiedzy po prostu pozostaje na miejscu. Ponieważ model jest open-weight, to klient wybiera środowisko uruchomieniowe. Dostarczamy aplikację w czterech wariantach: przez API Mistral, w naszej chmurze w UE, we własnym środowisku chmurowym klienta lub lokalnie u klienta. Ten wybór należy do organizacji, nie do dostawcy. W ten sposób unikają Państwo uzależnienia od dostawcy. Kto zachowuje kontrolę nad danymi, hostingiem i warstwą aplikacyjną, bez trudu zmienia model, gdy tylko pojawi się lepszy.

Najmniejszy pierwszy krok

Nie trzeba od razu migrować. Proszę zabrać te cztery pytania na następne spotkanie z dostawcą i zadać je także obecnym dostawcom. Proszę zapisać odpowiedzi wraz ze źródłami. To od razu dokumentacja dla zarządu, działu zakupów i organów nadzoru, a zarazem podstawa definicji roboczej, którą zaleca TNO [1]. Tabela oceny TNO jest publicznie dostępna na open.overheid.nl [2]. Chcą Państwo odnieść te pytania do własnej sytuacji? Podczas bezpłatnej 30-minutowej konsultacji omówimy możliwości. Więcej informacji znajdą Państwo na stronie AI Consulting Services. Jeżeli chcą Państwo najpierw sprawdzić, czy ład AI w organizacji jest gotowy na wybór modelu, GAP Assessment ISO/IEC 42001 ustala to w 40 do 60 godzin. A jeżeli wybrany model ma od razu pracować na własnych dokumentach, służy do tego Asystent AI Workspace.

Źródła

  1. TNO (2026). Open en Europese taalmodellen bij de overheid: definities en afwegingen (Otwarte i europejskie modele językowe w administracji publicznej: definicje i rozważania). Raport TNO-2026-17545, sierpień 2026 (w języku niderlandzkim). https://open.overheid.nl/details/6ba92fae-f8e6-48f0-a5d2-bf334b14ac5e
  2. Digitale Overheid (2026). Verkenning inzet open en Europese taalmodellen bij overheid, 1 września 2026 (w języku niderlandzkim). https://www.digitaleoverheid.nl/nieuws/verkenning-inzet-open-en-europese-taalmodellen-bij-overheid/

ASE Cloud Services Chatbot Interface

ASE Chatbot

Chat History

Send New Message

Vragen over: 10/10
Powered by ASE Cloud Services, in samenwerking met jou