Porównanie jakości tłumaczenia stron w Hugo – LLMs na Ollama
qwen3 8b, 14b i 30b, devstral 24b, mistral small 24b
W tym teście porównuję, jak różne LLMs hostowane na Ollama tłumaczą stronę Hugo z języka angielskiego na niemiecki.
qwen3 8b, 14b i 30b, devstral 24b, mistral small 24b
W tym teście porównuję, jak różne LLMs hostowane na Ollama tłumaczą stronę Hugo z języka angielskiego na niemiecki.
Wdrażasz RAG? Oto kilka fragmentów kodu w języku Golang.
Ten niewielki przykład kodu Go do rerankingu wywołuje Ollamę do generowania wektorów dla zapytania oraz dla każdego dokumentu kandydackiego, następnie sortuje wyniki malejąco według podobieństwa kosinusowego.
Czy myślisz o zainstalowaniu drugiej karty graficznej dla LLM?
Jak liczba linii PCIe wpływa na wydajność LLM? W zależności od zadania. Dla treningu i inferencji wielo-GPU spadek wydajności jest znaczący.
LLM do wyodrębniania tekstu z HTML...
W bibliotece modeli Ollama są modele, które potrafią konwertować zawartość HTML na Markdown, co jest przydatne w zadaniach związanych z konwersją treści. Ten przewodnik jest częścią naszego Narzędzia dokumentacyjne w 2026: Markdown, LaTeX, PDF i przepływ pracy druku hub.
Który tryb badawczy AI jest odpowiedni dla Twojego zadania?
Cursor AI vs GitHub Copilot vs Cline AI vs...
Poniżej przedstawiam listę kilku narzędzi do programowania wspieranych przez AI oraz Asystentów Programowania AI i ich atuty.
Krótki wykaz dostawców LLM
Użycie modeli językowych dużych (LLM) nie jest bardzo drogie, może nie być potrzeby zakupu nowego, wspaniałego GPU.
Oto lista, jeśli dostawcy LLM w chmurze z LLM, które hostują.
Ollama na procesorze Intel CPU: wydajność a jądra wydajne
Mam teorię do przetestowania – czy wykorzystanie Wszystkich rdzeni na procesorze Intel podniesie prędkość LLM? Zdenerwuje mnie fakt, że nowy model gemma3 27 bit (gemma3:27b, 17GB na ollama) nie mieści się w 16GB VRAM mojej karty graficznej, a częściowo działa na procesorze.
AI wymaga dużego poboru mocy...
Wśród współczesnych burz porównuję specyfikacje techniczne różnych kart odpowiednich do zadań w zakresie AI (Deep Learning, Object Detection oraz LLMs). Są one jednak niezwykle drogie.
Zrozum mechanizmy równoległości i kolejkowania w Ollamie oraz sposób kalibracji parametru OLLAMA_NUM_PARALLEL, aby zapewnić stabilne obsłużenie równoległych żądań.
Ten przewodnik wyjaśnia sposób, w jaki Ollama obsługuje żądania równoległe (równoległość, kolejkowanie i ograniczenia zasobów) oraz jak dostrajać ten proces przy użyciu zmiennej środowiskowej OLLAMA_NUM_PARALLEL (i powiązanych parametrów).
Programowanie wspierane przez AI, gdzie opisujesz zamiast wpisywać kod.
Vibe coding to napędzane przez sztuczną inteligencję podejście do programowania, w którym deweloperzy opisują pożądaną funkcjonalność w języku naturalnym, a narzędzia AI automatycznie generują kod – przy minimalnym bezpośrednim pisaniu.
Cały zestaw narzędzi MM* jest na końcu cyklu życia...
Używałem MMDetection (mmengine, mdet, mmcv) dość często,
a teraz wygląda na to, że wycofał się z gry.
To żal. Lubiłem jego zoo modeli.
Porównanie dwóch modeli deepseek-r1 z dwoma modelami bazowymi
Modeli DeepSeek pierwszego pokolenia z wydajnością porównywalną do modeli OpenAI-o1, w tym sześć gęstych modeli oddestylowanych z DeepSeek-R1 opartych na Llama i Qwen.
Zaktualizowana lista poleceń Ollama – ls, ps, run, serve itp.
Ten skrót klawiszowy do CLI Ollama ({Ollama CLI cheatsheet}) skupia się na komendach, których używasz codziennie (ollama ls, ollama serve, ollama run, ollama ps, zarządzanie modelami oraz typowe przepływy pracy), z przykładami, które możesz skopiować i wkleić.
Następny etap testów LLM
Nieco wcześniej wydano. Przejdźmy do sprawy i
testuj jak Mistral Small radzi sobie w porównaniu do innych LLM.
Kod Pythona do ponownego rankingu w RAG.