O projekcie
Po co to wszystko
Inferownia to polskojęzyczny hub wiedzy o lokalnym AI — czyli o uruchamianiu dużych i małych modeli językowych na własnym sprzęcie: laptopie, domowym PC z jedną kartą graficzną, mini-PC czy urządzeniu edge. Bez zależności od chmury, bez wysyłania danych na zewnątrz.
Interesuje nas praktyka warsztatu: kwantyzacja, inferencja na słabym sprzęcie, małe
modele, lokalny fine-tuning, RAG oraz narzędzia takie jak llama.cpp, GGUF czy Ollama.
Trzy działy
- Naukowy — omówienia świeżych papierów z arXiv (kategorie
cs.CL,cs.LG,cs.AI) napisane po polsku, własnymi słowami, z linkiem do oryginału. - Poradniki — konkretne how-to: jak odpalić model, jak skwantyzować wagi, jak zbudować lokalny RAG.
- Aktualności — krótkie notki o tym, co nowego w ekosystemie.
Kontakt i źródła
Treści dostępne są także przez kanał RSS. Każdy dział ma własny feed — znajdziesz go na stronie działu.