Strona główna / Rozdział 8 · Wybór modelu
    Ostatnia zmiana · 5 min czytania

    Użyj z AI

    Modele open-weight

    Open-weight znaczy: możesz pobrać wagi, czyli wyuczone macierze modelu, i uruchomić go na własnym sprzęcie. To nie to samo co open-source: zwykle nie dostajesz danych ani kodu treningu, a licencja może ograniczać użycie.

    Po ludzkuZamknięty model to restauracja: jesz, co podadzą, i nie zajrzysz do kuchni. Open-weight to gotowe danie na wynos: podgrzejesz i doprawisz u siebie, ale przepisu nie znasz. Open-source to danie razem z przepisem.

    Przełącz rodzaj modelu i zobacz, co dostajesz w paczce i co z tego wynika

    Co dostajesz, a czego nie

    Po co firmom self-hosting

    Ustaw cenę API, koszt węzła, miesięczny wolumen i to, ile obsłuży jeden węzeł. Zobacz, od jakiego obciążenia własne GPU zaczynają się opłacać

    Poglądowo. Przepustowość węzła mocno zależy od modelu i proporcji wejścia do wyjścia: 10 mld tokenów miesięcznie to ok. 3900 tokenów na sekundę bez przerwy, a DeepSeek podaje ok. 15 tys. tokenów wyjściowych albo 74 tys. wejściowych na sekundę na węzeł z 8 GPU dla swojego modelu MoE 671B (luty 2025). Cena API to średnia z cen tokenów wejściowych i droższych wyjściowych. Wykres pomija pracę ludzi przy utrzymaniu, a to zwykle największy koszt self-hostingu.

    Koszt self-hostingu i pułapki

    Sprawdź się

    Open-weight a open-source: jaka różnica i kiedy self-hostować?

    Open-weight znaczy, że można pobrać wagi i uruchomić model u siebie. Open-source według definicji OSI wymaga też kodu treningu, szczegółowego opisu danych i warunków bez ograniczeń użycia, a to rzadkość; licencje wag często ograniczają użycie, np. skalą albo regionem. Self-hosting daje kontrolę: dane zostają w firmie, wersja się nie zmienia, można dotrenować i skwantyzować. Płacisz za GPU i ludzi, a węzeł kosztuje tyle samo pusty i pełny, więc to się opłaca przy dużym, stałym ruchu albo twardych wymaganiach regulacyjnych. Pośrednia droga to otwarty model u zewnętrznego hosta.

    In English

    Open-weight means you can download the weights and run the model yourself. Open source, per the OSI definition, also requires the training code, a detailed description of the data and terms without use restrictions, which is rare; open-weight licences often restrict use, for example by scale or region. Self-hosting gives control: data stays in-house, the version never changes, and you can fine-tune and quantise. You pay for GPUs and people, and a node costs the same idle or full, so it pays off at high, steady volume or under hard regulatory constraints. The middle path is an open model from a third-party host.

    Pytania pogłębiające (4)
    Co sprawdzasz w licencji?
    Użycie komercyjne, progi skali (np. 700 mln aktywnych użytkowników miesięcznie w Llama), ograniczenia geograficzne (Meta nie udziela licencji na multimodalne modele Llama osobom mieszkającym w UE ani firmom z siedzibą w UE), listę zakazanych zastosowań, warunki dla modeli pochodnych i trenowania innych modeli na wynikach oraz wymogi atrybucji.
    Jak porównać hosta otwartego modelu z oryginałem?
    Tym samym zestawem ewaluacyjnym na konkretnym endpoincie, z naciskiem na tool calling, wymuszanie formatu i długi kontekst, bo tam różnice w kwantyzacji i szablonie czatu wychodzą najpierw. Zapisujesz też, jaką kwantyzację i wersję host deklaruje.
    Kiedy odradzisz self-hosting mimo niższej ceny za token?
    Gdy ruch jest nieregularny i węzeł przez większość czasu stoi pusty, gdy zespół nie ma ludzi do utrzymania serwowania albo gdy zadanie wymaga jakości czołowego modelu zamkniętego. Koszt liczysz przy realnym średnim obciążeniu, nie przy 100%.
    Klient wymaga, żeby dane nie opuszczały UE. Jakie masz opcje?
    Model zamknięty u dostawcy chmury w regionie UE z umową powierzenia przetwarzania danych, otwarty model u hosta w UE albo self-hosting. Wybór zależy od tego, czy wystarczy umowa i region, czy wymagana jest pełna kontrola nad infrastrukturą.

    Źródła

    Zgłoś błąd · Zaproponuj poprawkę