Przewiń do zawartości
Menu
Automationbro Logo Ver
Linkedin Newspaper Github

Lokalne AI na własnym sprzęcie

Kwantyzacja: dlaczego lokalnie nie masz pełnego modelu

Lokalne AIPrzez Michał Nowakowski2026-10-03

Model 27B w pliku 16 GB to 4,7 bita na wagę. Jak to policzyć z dwóch liczb, pięć wyjątków w tabeli 23 modeli i czego ta metoda nie powie.

Po ilu miesiącach zwraca się własny serwer AI?

Lokalne AIPrzez Michał Nowakowski2026-10-03

Przy abonamencie 20 EUR miesięcznie maszyna za 900 EUR zwraca się po 53 miesiącach. Pełny rachunek: cena sprzętu, zmierzony pobór mocy i co pomija.

Czego lokalne AI nie zrobi?

Lokalne AIPrzez Michał Nowakowski2026-10-01

Sufit 45,7 tokena na sekundę, największy uruchomiony plik 22,8 GB, jeden model naraz. Zmierzone granice domowego AI.

Jak uruchomić lokalny model AI na Ubuntu Server

Lokalne AIPrzez Michał Nowakowski2026-10-01

Trzy warstwy, które naprawdę trzeba postawić: Ubuntu Server bez pulpitu, llama.cpp jako silnik i LiteLLM jako brama API.

Jak przyspieszyć lokalny model AI? MTP, DFlash i reszta metod

Lokalne AIPrzez Michał Nowakowski2026-10-01

MTP, DFlash, speculative decoding, kwantyzacja, MoE i krótszy kontekst – trzy grupy metod przyspieszania lokalnego modelu, z moimi pomiarami z września 2026 i cudzymi liczbami podanymi ze źródłem.

JEPA i LLaDA: modele AI, które działają inaczej niż LLM

Lokalne AIPrzez Michał Nowakowski2026-10-01

JEPA przewiduje reprezentacje, nie tekst. LLaDA odsłania tekst z masek, nie pisze od lewej do prawej. Definicje, przykłady z otwartymi wagami i to, co da się uruchomić w domu.

Dlaczego model 30B potrafi być szybszy niż 12B?

Lokalne AIPrzez Michał Nowakowski2026-09-30

Model MoE 30B robi 30,4 tokena na sekundę, gęsty 12B na dłuższym kontekście – 11,3. O prędkości decyduje przede wszystkim liczba parametrów aktywnych na token, a nie liczba w nazwie modelu.

16 GB czy 32 GB do lokalnego AI?

Lokalne AIPrzez Michał Nowakowski2026-09-30

Model 30B o obniżonej precyzji zajmuje 15–19 GB, więc w 16 GB nie zostaje nic na resztę. Zmierzone rozmiary plików i prędkości, i co naprawdę kupujesz za te 80–100 EUR.

Jaki model AI uruchomisz lokalnie na mini PC?

Lokalne AIPrzez Michał Nowakowski2026-09-30

Zmierzone na jednej maszynie ze zintegrowanym Radeonem 890M i 32 GB RAM: który model działa, ile tokenów na sekundę i dlaczego 30B bywa szybsze niż 12B.

Ile prądu zużywa domowy serwer AI z APU zamiast GPU?

Lokalne AIPrzez Michał Nowakowski2026-09-30

3–8 W na biegu jałowym, około 130 W pod pełnym obciążeniem. Całe wyliczenie w kWh, żebyś podstawił własną stawkę z rachunku za prąd.

→12→

2026 Automationbro © Michał Nowakowski – wszelkie prawa zastrzeżone

by AutomationBRO

Do góry
Linkedin Newspaper Github
  • O mnie
  • Dla Ciebie
  • Dla Firm
  • Artykuły
  • Do pobrania
  • Publikacje
  • Kontakt
Automationbro Logo Sqr
  • O mnie
  • Dla Ciebie
  • Dla Firm
  • Artykuły
  • Do pobrania
  • Publikacje
  • Kontakt
Linkedin Feather-file-text Github