2026-10-10
(Ostatnia modyfikacja:
2026-10-10)
— Napisane przez
SimeonOnSecurity
— 9 min czytania
Porównanie oparte na benchmarkach dwóch kart RTX 5060 Ti 16 GB i systemu NVIDIA GB10 dla Qwen 3 27B oraz lokalnego wnioskowania z długim kontekstem.
Wydajność lokalnego modelu zależy od architektury pamięci, nie tylko od liczby GPU.
#lokalny LLM
#lokalne wnioskowanie
#pamięć współdzielona
#VRAM
2026-10-10
(Ostatnia modyfikacja:
2026-10-10)
— Napisane przez
SimeonOnSecurity
— 9 min czytania
Prześledź prompty, pliki modeli, narzędzia, logi, ekspozycję sieciową i koszty energii przed wyborem lokalnego wnioskowania albo hostowanej usługi AI.
Ilustracja lokalnych i hostowanych ścieżek danych AI
#lokalne wnioskowanie
#llama.cpp
2026-10-06
(Ostatnia modyfikacja:
2026-10-10)
— Napisane przez
SimeonOnSecurity
— 9 min czytania
Porównanie lokalnej AI z ChatGPT i Claude na podstawie wyników testów, szacunków pamięci, szybkości obsługi i weryfikacji agentów. Omówiono RTX 5090, DGX Spark i Mac Studio.
Koncepcyjna ilustracja lokalnej i hostowanej AI.
#lokalny LLM
#kwantyzacja
#pamięć współdzielona
#VRAM
#lokalne wnioskowanie
2026-10-06
(Ostatnia modyfikacja:
2026-10-10)
— Napisane przez
SimeonOnSecurity
— 9 min czytania
Uruchom lokalnego agenta programistycznego ze Stratą i OpenCode. Sprawdź zgłoszone wyniki RTX 4060 Ti, wymagania RAM, ponowne użycie promptów, budżety rozumowania oraz ograniczenia zastępowania płatnej subskrypcji.
#lokalne wnioskowanie
#Docker
#okno kontekstu