Self-Hosting

Тест: Как Ollama использует производительность процессоров Intel и эффективные ядра

Тест: Как Ollama использует производительность процессоров Intel и эффективные ядра

Ollama на процессорах Intel: эффективность против производительных ядер

У меня есть теория, которую нужно проверить - использование всех ядер Intel CPU повысит скорость работы LLMs? (Тест: Как Ollama использует производительность и эффективные ядра Intel CPU)

Меня беспокоит, что новая модель gemma3 27 бит (gemma3:27b, 17ГБ в ollama) не помещается в 16ГБ видеопамяти моей GPU и частично работает на CPU.

Сравнение пригодности GPU от NVIDIA для задач искусственного интеллекта

Сравнение пригодности GPU от NVIDIA для задач искусственного интеллекта

ИИ требует значительного энергопотребления...

В условиях современной турбулентности я сравниваю технические характеристики различных видеокарт, подходящих для задач ИИ (Глубокое обучение, Обнаружение объектов и Языковые модели). Они все невероятно дороги.

Топ тем Hugo

Топ тем Hugo

Наиболее популярные темы для Hugo

Давайте посмотрим на github список лучших тем для Hugo статического генератора сайтов,
и проверим их рейтинг звёзд.
Вы можете перейти к официальному списку тем Hugo: https://themes.gohugo.io/

Как Ollama обрабатывает параллельные запросы

Как Ollama обрабатывает параллельные запросы

Поймите механизм параллелизма и очередей в Ollama, а также настройте OLLAMA_NUM_PARALLEL для стабильной обработки параллельных запросов.

В этом руководстве объясняется как Ollama обрабатывает параллельные запросы (конкурентность, очередь и ограничения ресурсов) и как настроить это с помощью переменной окружения OLLAMA_NUM_PARALLEL (и связанных параметров).

Установка Portainer в Linux

Установка Portainer в Linux

Немного системного администрирования

Возможно, теперь эту статью следует назвать инженерия платформ, так как она стала такой. Вот несколько заметок о том, как установить Portainer и удалить его — графический интерфейс для управления образами и контейнерами Docker.

Тестирование Deepseek-R1 на Ollama

Тестирование Deepseek-R1 на Ollama

Сравнение двух моделей deepseek-r1 с двумя базовыми

DeepSeek’s первая генерация моделей рассуждений с производительностью, сопоставимой с OpenAI-o1, включает шесть плотных моделей, дистиллированных на основе Llama и Qwen.

Быстрый старт PyInstaller

Быстрый старт PyInstaller

Объединение Python-программы в один файл

Используйте PyInstaller
для упаковки Python
программ в отдельные исполняемые файлы. Работает на Linux, Windows и Mac.

Не самый эффективный способ, но пригодный для использования.

Добавление разметки структурированных данных в Hugo

Добавление разметки структурированных данных в Hugo

Если тема Hugo не поддерживает структурированные данные...

Google показывает в результатах поиска некоторые улучшения, такие как детали фильмов, объявления о вакансиях, информация об мероприятиях и курсах, которые он получает с сайта Структурированные данные. Вот как - Как добавить структурированные данные на сайт с использованием генератора Hugo.