Rozwój LLM · Dopasowany do Twoich danych

Dedykowane modele LLM dopasowane do Twoich danych i systemów

theBlue.ai buduje dla firm dedykowane systemy LLM: modele językowe dopasowane do Twoich dokumentów, słownictwa i procesów, połączone z oprogramowaniem, którego już używasz, zarówno ze standardowymi produktami, jak i z systemami własnymi. Działają on-premise, w chmurze lub hybrydowo, zależnie od Twoich zasad compliance. Ponad 100 projektów AI od 2016 roku.

W TWOJEJ SIECI E-mail PDF / skan Notatki Model językowy dopasowany do danych DANE WYJŚCIOWE klientNorthwind pozycjedopasowano 8 z 8 dostawa14 marca adresweryfikacja ZAPIS DO ERP CRM DMS Własny Dokumenty na wejściu, ustrukturyzowane pola na wyjściu, w Twojej infrastrukturze

Fakty

Modele językowe na produkcji w trzech liczbach

W theBlue.ai zrealizowaliśmy od 2016 roku ponad 100 projektów AI i automatyzacji, wiele z nich na bazie modeli językowych. Lokalne modele uruchamiamy też na własne potrzeby i właśnie z tego doświadczenia wynikają nasze rekomendacje dotyczące wyboru modelu, sprzętu i kosztów.

100+
Zrealizowanych projektów AI i automatyzacji
10+
Lat doświadczenia w projektach AI
20M
Tokenów dziennie przetwarzanych przez jeden model lokalny, czyli ok. 15 000 stron

Wybrane organizacje, dla których budowaliśmy rozwiązania

Co przejmuje

Sześć zadań, które dedykowany model językowy wykonuje dziś w firmach

Każde z nich pochodzi z systemu zbudowanego przez nas i działającego na prawdziwych danych klienta. Liczba na karcie to zmierzony wynik.

Jak to działa

Od e-maila klienta do gotowego zamówienia

Od: orders@northwind-installations.example
Temat: Zamówienie na przyszły tydzień Zamówienie · 0,97

Dzień dobry,

prosimy o dostawę: 6 × kabina prysznicowa 90×90, chrom oraz 2 × brodzik 90×90, biały. Całość musimy mieć do piątku, 14 marca.

Pozostałe pozycje zamówienia są w załączonym pliku.

Pozdrawiam,
Anna, Northwind Installations

📎 zamowienie_4711.pdf · 2 kolejne pozycje

Zamówienie sprzedaży · szkic

Klient
Northwind Installations✓
Pozycje
8 pozycji, 8 z 8 dopasowanych do bazy produktów✓
Termin dostawy
14 marca✓
Adres dostawy
Brak, oznaczono do weryfikacji
Szkic trafia do działu zamówień · 1 pole do sprawdzenia przez pracownika
−90%Ręcznych interwencji przy wprowadzaniu zamówień
95%+Trafności dopasowania produktów
3 tygodnieOd przeglądu technicznego do wdrożenia produkcyjnego

Przykład poglądowy. Dane z case study Radaway.

Wybór podejścia

Prompt engineering, RAG czy dostrajanie modelu: co wybrać

Większość projektów nie wymaga trenowania modelu od zera. Zaczynamy od najlżejszego podejścia, które spełnia wymagania, a po bardziej złożone sięgamy dopiero wtedy, gdy Twoje dane pokażą, że to konieczne.

Kryterium PROMPTPrompt engineering RAGGenerowanie wspomagane wyszukiwaniem TUNEModel dostrojony lub dedykowany
Jak to działa Ogólny model z promptami i formatami odpowiedzi przygotowanymi pod Twoje zadanie. Model odpowiada na podstawie Twoich dokumentów, wyszukanych w chwili zadania pytania, i podaje źródło. Model bazowy dodatkowo trenowany na przykładach z Twoich danych.
Sprawdza się, gdy Zadanie jest jasno określone: ekstrakcja, klasyfikacja, streszczenia. Wiedza często się zmienia, a każda odpowiedź wymaga źródła. Słownictwo jest bardzo specjalistyczne, styl odpowiedzi jest z góry ustalony albo mniejszy model musi obsłużyć duży wolumen.
Czego wymaga Dobrych przykładów i etapu walidacji. Dostępu do Twoich repozytoriów dokumentów i wyszukiwania dostrojonego do Twojej branży. Wystarczającej liczby czystych przykładów treningowych i zbioru testowego do pomiaru wyników.
Nakład pracy Najniższy Średni Najwyższy
Z naszych projektów Fr. Meyer’s Sohn: modele GPT z promptami dopracowanymi pod e-maile logistyczne apoQlar: odpowiedzi na podstawie setek dokumentów produktowych, z odwołaniami do źródeł Arvato Bertelsmann: NLP i dedykowane modele do podsumowań rozmów

Podejścia można łączyć: dostrojony model może działać za etapem wyszukiwania, a każde z nich wymaga walidacji. Jakie połączenie pasuje do Twojego procesu, ustalamy w analizie procesu, zanim cokolwiek zbudujemy. Jeśli potrzebujesz odpowiedzi na podstawie własnych dokumentów, zobacz Systemy RAG.

Wdrożenie

O tym, gdzie działa Twój model, decydujesz Ty

On-premise, Twój tenant w chmurze, model hybrydowy lub model hostowany. Wybór zależy od Twoich wymagań bezpieczeństwa, a ustalamy go na piśmie, zanim cokolwiek zbudujemy.

On-premise

Lokalne modele open source na Twoim własnym sprzęcie. Dokumenty nigdy nie opuszczają Twojej sieci i nie mogą trafić do żadnego dostawcy.

Twój tenant w chmurze

Twój własny tenant w chmurze, np. w Azure, w ramach obowiązujących umów i zasad bezpieczeństwa.

Model hybrydowy

Wrażliwe etapy działają lokalnie, pozostałe korzystają z modelu hostowanego. To, który etap działa gdzie, określa architektura.

Modele hostowane

Najmocniejsze modele komercyjne tam, gdzie mają sens. Jako OpenAI Select Partner potrafimy dobrze je wykorzystać, a warunki korzystania z danych najpierw uzgadniamy na piśmie.

Sami korzystamy z modeli lokalnych

W theBlue.ai działają dziś produkcyjnie trzy lokalne modele. Każdy wybraliśmy pod konkretne zadanie, porównując dokładność, szybkość, długość kontekstu, obsługę języków i wymagania sprzętowe.

  • Gemma 4 26BAnaliza przetargów: 15 do 20 milionów tokenów dziennie, ok. 15 000 stron A4, przy czym użytkownik czeka na wynik
  • Gemma 4 31BMonitoring polityczny: ok. 28 milionów tokenów dziennie w zadaniach w tle, gdzie dokładność liczy się bardziej niż szybkość
  • Qwen3 30BWewnętrzny chatbot wiedzy: RAG na naszej własnej dokumentacji, na naszych własnych GPU
Zobacz, jak korzystamy z lokalnych LLM

Kompromisy, o których mówimy wprost

  • Sprzęt to inwestycja na starcie. Zwraca się przy dużych wolumenach, a przy okazjonalnym użyciu hostowane API może być tańsze.
  • Twój sprzęt wyznacza górną granicę wielkości modelu.
  • W najtrudniejszych zadaniach wymagających rozumowania czołowe modele komercyjne wciąż mogą wypadać lepiej.
  • Lokalny model trzeba hostować, monitorować i aktualizować, co oznacza stałą pracę.

Bezpieczeństwo i zgodność

Twój dział bezpieczeństwa widzi przepływ danych, zanim podejmiesz decyzję

Przepływ danych ustalony na piśmie

W Etapie 1, jeszcze przed rozpoczęciem wdrożenia, ustalamy, jakie dane trafiają dokąd i czy którekolwiek z nich docierają do dostawcy modelu.

RODO wbudowane w system

Tam, gdzie w grę wchodzą dane osobowe, deidentyfikacja i anonimizacja są częścią systemu, tak jak w naszych projektach dla Tirol Kliniken, InSaaS.ai i klienta z branży farmaceutycznej.

Gotowe na Twój przegląd bezpieczeństwa

Dostosowujemy się do Twojej infrastruktury i procedur przeglądu bezpieczeństwa. theBlue.ai działa w ramach grupy Apollogic, która posiada certyfikat ISO 9001.

Opinia klienta

Co mówi klient po zakończeniu projektu

Ochrona zdrowia · Organizacja pracy szpitala

System AI, który anonimizuje dane pacjentów na własnych serwerach szpitala

100%Ręczna anonimizacja wyeliminowana
On-premDziała na serwerach szpitala, bez chmury
Zobacz projekt
Rosnące zapotrzebowanie na anonimizację zamieniło się w czasochłonny, ręczny proces. Razem z theBlue.ai przekształciliśmy to wyzwanie w sprawny proces oparty na AI, który znacząco ograniczył pracę ręczną i odciążył nasz zespół.
Pietro Lucillo, MA IT Project Manager, Tirol Kliniken

Jak zacząć

Dwa sposoby na start, oba na małą skalę

Żaden nie wymaga dużego kontraktu. Widzisz, co jest możliwe i czego to wymaga, zanim zdecydujesz się na budowę systemu.

Bezpłatnie · odpowiedź w ciągu jednego dnia roboczego

Opisz swój proces

Powiedz nam, gdzie tkwi praca ręczna. W ciągu jednego dnia roboczego wrócimy do Ciebie ze wstępną oceną, czy model językowy może pomóc, i propozycją 30-minutowej rozmowy o zakresie.

Opisz swój proces
Stała cena · od 3000 €

Zacznij od analizy procesu

Mapujemy przebiegi pracy, sprawdzamy Twoje dane pod kątem możliwości dzisiejszych modeli i proponujemy architekturę z zakresem, harmonogramem i kosztami. Samodzielne zlecenie, bez zobowiązania do dalszej współpracy.

Zobacz, jak pracujemy
  1. 1
    Analiza procesuStała cena od 3000 €, architektura i koszty na piśmie
  2. 2
    Budowa i integracjaRozliczenie według kamieni milowych, pierwsze działające komponenty po sześciu do ośmiu tygodniach
  3. 3
    Uruchomienie i przekazanieDokumentacja, szkolenia i możliwość stałego wsparcia

FAQ

Pytania o dedykowane modele LLM

Rozwój dedykowanego LLM to dopasowanie dużego modelu językowego do dokumentów, słownictwa i procesów konkretnej firmy oraz zbudowanie wokół niego całego systemu: walidacji, integracji z istniejącym oprogramowaniem i wdrożenia zgodnego z zasadami bezpieczeństwa firmy. Dopasowanie może polegać na prompt engineeringu, generowaniu wspomaganym wyszukiwaniem (RAG), dostrajaniu modelu (fine-tuningu) lub ich połączeniu. theBlue.ai buduje takie systemy on-premise, w chmurze lub hybrydowo.

RAG sprawdza się, gdy wiedza często się zmienia, a każda odpowiedź wymaga źródła, np. przy dokumentacji produktowej lub wewnętrznych regulaminach. Dostrajanie ma sens, gdy słownictwo jest bardzo specjalistyczne, styl odpowiedzi jest z góry ustalony albo mniejszy model musi przetworzyć duży wolumen. Do wielu zadań, takich jak ekstrakcja danych z e-maili, wystarczy sam prompt engineering. Zaczynamy od najlżejszego podejścia, które spełnia wymagania, a decyzję podejmujemy na podstawie danych, w ramach analizy procesu.

Nie. Przy wrażliwych procesach theBlue.ai uruchamia lokalne modele na Twoim własnym sprzęcie: dokumenty nigdy nie opuszczają Twojej sieci i nie mogą trafić do żadnego dostawcy. Gdy korzystamy z dostawcy chmurowego, zawsze upewniamy się, że wykorzystywanie Twoich danych do trenowania jest wyłączone. Przy wdrożeniach przez API Twoje dane domyślnie nie są używane do trenowania. Wybór wariantu ustalamy, zanim cokolwiek zbudujemy.

Tak. theBlue.ai wdraża systemy on-premise, w chmurze, hybrydowo lub z modelem hostowanym, zależnie od Twoich wymagań bezpieczeństwa i infrastruktury. W Tirol Kliniken system działa na własnych serwerach szpitala, a w Fr. Meyer’s Sohn w Dockerze na serwerach firmy. Na własne potrzeby uruchamiamy też produkcyjnie trzy lokalne modele.

Zarówno z modelami hostowanymi, jak i open source. Jako OpenAI Select Partner korzystamy z modeli OpenAI tam, gdzie pasują; system dla Fr. Meyer’s Sohn wykorzystuje GPT-3.5 i GPT-4. Przy wdrożeniach lokalnych pracujemy z rodzinami modeli open source, takimi jak Gemma, Llama i Qwen. Model dobieramy do zadania, porównując dokładność, szybkość, długość kontekstu, obsługę języków i wymagania sprzętowe.

Nasze systemy produkcyjne obsługują niemiecki i angielski, a kilka z nich także inne języki: system farmakowigilancji analizuje teksty medyczne po niemiecku, angielsku, francusku, włosku i hiszpańsku, a nasza analiza przetargów działa na polskich dokumentach. Obsługa języków to jedno z kryteriów przy wyborze modelu.

Pierwsze działające komponenty pojawiają się zwykle po sześciu do ośmiu tygodniach prac. Jeśli system już istnieje, może to pójść szybciej: istniejący system LLM firmy Radaway doprowadziliśmy od przeglądu technicznego do wdrożenia produkcyjnego w trzy tygodnie.

Analiza procesu ma stałą cenę od 3000 € i kończy się propozycją architektury, która określa zakres, harmonogram i koszty budowy. Samą budowę wyceniamy według kamieni milowych, więc koszt każdego kroku znasz, zanim się rozpocznie. Po analizie decydujesz, czy idziemy dalej.

Zwykle bez zaczynania od nowa. Prototypy, które działają w kontrolowanych warunkach, ale zawodzą na produkcji, to częsty przypadek. Przyczyna leży zazwyczaj w kilku komponentach: promptach, formatach odpowiedzi, walidacji i przypadkach brzegowych. Przeglądamy to, co istnieje, zachowujemy to, co działa, a resztę budujemy od nowa. Właśnie tak system firmy Radaway trafił na produkcję w trzy tygodnie.

System startuje na prawdziwych danych, a my uważnie go monitorujemy, dopracowujemy na podstawie jego rzeczywistego działania i przekazujemy z pełną dokumentacją i szkoleniem. Dostępne jest też stałe wsparcie, co ma największe znaczenie przy modelach lokalnych: trzeba je hostować, monitorować i aktualizować.

Powiedz nam, który proces kosztuje Cię najwięcej

Opisz proces, a w ciągu jednego dnia roboczego wrócimy do Ciebie ze wstępną oceną i propozycją 30-minutowej rozmowy o zakresie.

  • Etap 1 to samodzielne zlecenie, bez zobowiązania do dalszej współpracy.
  • Doświadczeni inżynierowie od pierwszego dnia. Bez opiekunów klienta i bez przekazywania projektu z rąk do rąk.
  • Integrujemy, nie zastępujemy. Twoje systemy pozostają dokładnie takie, jakie są.

Nie wiesz, od którego procesu zacząć? Opisz, gdzie ucieka najwięcej czasu, a ustalimy to razem.

* Pola wymagane.

Odpowiemy w ciągu jednego dnia roboczego.