Self-Hosting

Ollama zu vLLM: Wann Sie Ihren lokalen LLM-Server migrieren sollten

Ollama zu vLLM: Wann Sie Ihren lokalen LLM-Server migrieren sollten

Wann man von Ollama zu vLLM wechseln sollte

Ollama ist eine der einfachsten Methoden, um ein lokales Sprachmodell auszuführen, doch Bequemlichkeit kann den Moment verbergen, in dem ein lokales Experiment zu einem gemeinsam genutzten Inferenzdienst wird, der einer besseren Planung und Observability bedarf.

Podman Quadlet vs. Docker Compose für Linux-Dienste

Podman Quadlet vs. Docker Compose für Linux-Dienste

Wählen Sie den richtigen Container-Workflow.

Docker Compose und Podman Quadlet lösen überlappende Probleme, stammen jedoch aus unterschiedlichen Designzentren. Die Wahl zwischen ihnen hängt davon ab, ob Sie in Anwendungsstacks oder in Linux-Dienste denken.

Docker Compose als Linux-Dienst mit systemd ausführen

Docker Compose als Linux-Dienst mit systemd ausführen

Docker Compose beim Systemstart, verwaltet durch systemd.

Ein Docker Compose-Projekt auf einem Linux-Server sollte beim Booten starten, beim Herunterfahren sauber gestoppt werden und Neustarts ohne manuelle Eingriffe überstehen.

Vane (Perplexica 2.0) Schnellstart mit Ollama und llama.cpp

Vane (Perplexica 2.0) Schnellstart mit Ollama und llama.cpp

Selbst gehostete KI-Suche mit lokalen LLMs

Vane ist einer der pragmatischeren Einträge im Bereich „KI-Suche mit Quellenangaben": eine selbst gehostete Antwortmaschine, die live abrufbare Websuche mit lokalen oder Cloud-LLMs kombiniert, während der gesamte Stack unter Ihrer Kontrolle bleibt.