Inferownia. // miejsce, gdzie odpalasz modele

O projekcie

Po co to wszystko

Inferownia to polskojęzyczny hub wiedzy o lokalnym AI — czyli o uruchamianiu dużych i małych modeli językowych na własnym sprzęcie: laptopie, domowym PC z jedną kartą graficzną, mini-PC czy urządzeniu edge. Bez zależności od chmury, bez wysyłania danych na zewnątrz.

Interesuje nas praktyka warsztatu: kwantyzacja, inferencja na słabym sprzęcie, małe modele, lokalny fine-tuning, RAG oraz narzędzia takie jak llama.cpp, GGUF czy Ollama.

Trzy działy

  • Naukowy — omówienia świeżych papierów z arXiv (kategorie cs.CL, cs.LG, cs.AI) napisane po polsku, własnymi słowami, z linkiem do oryginału.
  • Poradniki — konkretne how-to: jak odpalić model, jak skwantyzować wagi, jak zbudować lokalny RAG.
  • Aktualności — krótkie notki o tym, co nowego w ekosystemie.

Kontakt i źródła

Treści dostępne są także przez kanał RSS. Każdy dział ma własny feed — znajdziesz go na stronie działu.