Reklama
Reklama
  • WIADOMOŚCI
  • WAŻNE

Polskie modele AI na zakręcie. Pytamy o ich przyszłość [DEBATA]

Czworo uczestników debaty o rozwoju polskich modeli językowych na scenie Cyber24 DAYS. Jeden z panelistów mówi do mikrofonu, w tle ekran z nazwiskami uczestników oraz flagi Polski i NATO.
W panelu uczestniczyli dr Agnieszka Karlińska, prof. Krzysztof Stereńczak z Instytutu Badawczego IDEAS, Karol Tajduś z Banku Pekao oraz Krzysztof Chibowski związany ze środowiskiem SpeakLeash i Bielika.
Autor. CyberDefence24

Poziom rozpoznania i zrozumienia języka polskiego przestaje już być wystarczającym argumentem za rozwijaniem rodzimych modeli językowych. Te zagraniczne radzą sobie z naszym językiem coraz lepiej. Podczas Cyber24 DAYS przedstawiciele nauki, biznesu i środowiska Bielika spierali się o to, gdzie warto inwestować pieniądze i pracę inżynierów. Wskazywali na specjalizację, wykorzystanie danych organizacji i możliwość utrzymania usług bez zagranicznego dostawcy. Różnili się jednak w ocenie, jaką rolę powinien odgrywać w tym polski model.

Reklama

Po co Polsce własne duże modele językowe, skoro rozwiązania zagraniczne są powszechnie dostępne, coraz sprawniejsze i rozwijane za pieniądze, z którymi trudno konkurować?

Takie pytanie otworzyło debatę „AI mówi po polsku. Co dalej z rozwojem naszych LLM-ów?” podczas Cyber24 DAYS. Dyskusja dotyczyła zarówno dalszych prac nad Bielikiem i PLLuM, jak i tego, co powinno powstać wokół tych projektów, aby ich rozwój przynosił korzyści gospodarce i administracji.

Eksperci (dr Agnieszka Karlińska, prof. Krzysztof Stereńczak z Instytutu Badawczego IDEAS, Karol Tajduś z Banku Pekao oraz Krzysztof Chibowski związany ze środowiskiem SpeakLeash i Bielika – red.) dostrzegali wartość kompetencji zbudowanych przy polskich projektach.

Znacznie więcej wątpliwości budziło to, czy należy próbować dorównać największym modelom ogólnego przeznaczenia, czy skupić się na rozwiązaniach wyspecjalizowanych.

Osobną kwestią pozostaje budowanie suwerenność Polski rozumianej jako posiadanie własnej technologii, ale też jako zdolność wyboru, zmiany dostawcy i dalszego działania w razie kryzysu.

Polski język już nie wystarczy

Agnieszka Karlińska zwracała uwagę, że uzasadnienie dla budowy polskich modeli zmieniło się od czasu rozpoczęcia prac nad PLLuM.

W początkowym okresie istotnym problemem był ograniczony dostęp do modeli o otwartych wagach, które dobrze realizowały zadania po polsku. Obecnie, jak oceniała, zagraniczne rozwiązania coraz lepiej radzą sobie z naszym językiem, a oferta dostępnych modeli znacznie się poszerzyła, między innymi za sprawą projektów chińskich.

Reklama
Panelistka w okularach i szarej marynarce mówi do mikrofonu na scenie Cyber24 DAYS; siedzący obok moderator i panelista zwracają się w jej stronę.
Coraz lepsza znajomość polszczyzny w zagranicznych modelach sprawia, że krajowe projekty muszą szukać przewag w specjalizacji i praktycznych zastosowaniach.
Autor. CyberDefence24

W jej ocenie argument odwołujący się wyłącznie do znajomości polszczyzny i lokalnej kultury stracił część swojej siły. Odbiorca technologii porównuje dostępne możliwości. Jeśli model zagraniczny wykonuje jego zadanie wystarczająco dobrze, samo krajowe pochodzenie konkurencyjnego rozwiązania może nie przesądzić o wdrożeniu.

Zmieniły się również oczekiwania. Karlińska wskazywała na rozwój rozwiązań agentowych oraz całego otoczenia modeli: dostępu do narzędzi, pamięci i mechanizmów oceny wykonywanych zadań. W takim systemie wygenerowanie poprawnej językowo odpowiedzi jest tylko jednym z elementów pracy. Model musi współdziałać z pozostałymi częściami rozwiązania.

Biznes oczekuje jakości i funkcjonalności

Karol Tajduś, dyrektor Departamentu Transformacji AI w Banku Pekao, przedstawiał perspektywę instytucji, która dobiera technologię do wymagań swoich procesów.

Reklama

Krytycznie oceniał możliwość zastąpienia czołowych rozwiązań zagranicznych polskimi modelami we wszystkich zastosowaniach. Wskazywał na różnice jakościowe i skalę zasobów stojących za rozwojem największych systemów.

Panelista w granatowym garniturze mówi do mikrofonu podczas debaty na Cyber24 DAYS; pozostali uczestnicy słuchają, w tle logo konferencji oraz flagi Polski i NATO.
Biznes oczekuje od modeli AI jakości i funkcjonalności dopasowanych do konkretnych zadań — samo polskie pochodzenie technologii nie przesądza o jej wyborze.
Autor. CyberDefence24

Była to ocena potrzeb wdrożeniowych banku, a nie wynik zaprezentowanego podczas panelu porównania wszystkich dostępnych modeli. Jej sens sprowadzał się jednak do istotnego warunku: pochodzenie technologii nie zwalnia jej z konieczności spełnienia wymagań konkretnego zastosowania. Tam, gdzie od modelu zależy działanie procesu, liczy się jakość uzyskanego rezultatu.

Karlińska dodawała perspektywę doświadczeń organizacji wybierających modele zagraniczne, gdzie przeszkodami w wykorzystaniu polskich rozwiązań bywają ograniczenia długości kontekstu, czyli ilości materiału, z którym model może pracować jednocześnie, oraz funkcji potrzebnych do budowania systemów agentowych. Znaczenie ma także zdolność zwracania wyników w uporządkowanej postaci, użytecznej dla innych elementów oprogramowania.

Reklama

Najtrwalszym efektem mogą być zespoły

Krzysztof Chibowski przypominał jednak o dodatkowej wartości płynącej z budowy polskich modeli – powstanie zespołów rozumiejących tę technologię od środka. To wiedza potrzebna zarówno do rozwijania własnych rozwiązań, jak i świadomej oceny produktów dostępnych na rynku.

Chibowski opisywał pracę polegającą na analizowaniu modeli i sprawdzaniu, jak są zbudowane. Tego rodzaju doświadczenie daje większą samodzielność niż samo korzystanie z gotowej usługi. Pozwala eksperymentować, rozpoznawać ograniczenia i decydować, które elementy można dostosować do własnych potrzeb.

Dwaj paneliści siedzą w czarnych fotelach z mikrofonami i słuchają debaty na Cyber24 DAYS; za nimi stoją flagi Polski i NATO.
Jednym z najtrwalszych efektów rozwoju Bielika i PLLuM są zespoły zdolne samodzielnie tworzyć, dostrajać i oceniać modele AI.
Autor. CyberDefence24

Spór dotyczył zatem przede wszystkim dalszego wykorzystania tych zasobów. Zbudowanie zespołu zdolnego trenować model tworzy możliwości, ale nie wyznacza automatycznie kolejnego celu. Może nim być większy model ogólny, rozwiązanie branżowe, nowa metoda badawcza albo system wykorzystujący kilka różnych modeli. Każdy z tych kierunków wymaga innego uzasadnienia.

Reklama

Dane i system wokół modelu

Prof. Stereńczak pokazywał z kolei perspektywę zastosowań opartych na cyfrowym odwzorowaniu rzeczywistości. Opisywał wykorzystanie danych teledetekcyjnych i środowiskowych oraz możliwości budowania systemu, w którym użytkownik wydaje polecenie w języku naturalnym, a następnie uruchamiane są odpowiednie procesy analityczne.

W tej koncepcji model językowy pomaga w interakcji z bardziej rozbudowanym środowiskiem. Znaczenie mają dane, powiązane narzędzia i możliwość sprawdzania scenariuszy. W rozmowie pojawiły się przykłady informacji o temperaturze, danych obrazowych i prac nad wykrywaniem pożarów.

Panelista w ciemnym garniturze i niebieskim krawacie mówi do mikrofonu i gestykuluje podczas Cyber24 DAYS, siedząc między pozostałymi uczestnikami debaty.
O niezależności organizacji współdecydują kontrola nad danymi i możliwość zmiany modelu bez przebudowy całego systemu.
Autor. CyberDefence24

Prof. Stereńczak podkreślał potrzebę budowania środowiska, w którym możliwa będzie podmiana modelu. Wartość i autonomia takiego rozwiązania wiązałyby się w dużej mierze z tym, co powstaje wokół LLM-u: zasobami informacji, sposobem ich wykorzystania i funkcjami całego systemu.

Zobacz również
CyberDefence24.pl - Digital EU Ambassador

Serwis CyberDefence24.pl otrzymał tytuł #DigitalEUAmbassador (Ambasadora polityki cyfrowej UE). Jeśli są sprawy, które Was nurtują; pytania, na które nie znacie odpowiedzi; tematy, o których trzeba napisać – zapraszamy do kontaktu. Piszcie do nas na: [email protected].

Reklama