OpenAI

Démarrage rapide de llama.cpp avec le CLI et le serveur

Démarrage rapide de llama.cpp avec le CLI et le serveur

Comment installer, configurer et utiliser OpenCode

Je reviens sans cesse à llama.cpp pour l’inférence locale — il vous offre un contrôle que Ollama et autres outils abstractent, et il fonctionne tout simplement. Facile d’exécuter des modèles GGUF de manière interactive avec llama-cli ou d’exposer une API HTTP compatible OpenAI avec llama-server.