Llm

Mnemosyne для агента Hermes: быстрое начало работы с локальной памятью

Mnemosyne для агента Hermes: быстрое начало работы с локальной памятью

Локальная память Hermes с контролируемой записью.

Mnemosyne — это локальный провайдер памяти для Hermes Agent, который хранит рабочую память, структурированные факты, временные данные и эпизодическую историю в локальной базе SQLite — без хостинг-сервисов, без обязательных сетевых вызовов и с исключительно детальным контролем записи.

Самоусиливающиеся петли памяти в ИИ-агентах: причины и способы исправления

Самоусиливающиеся петли памяти в ИИ-агентах: причины и способы исправления

«Когда осмысленные выводы превращаются в новые доказательства.»

Персистентная память превращает агента из инструмента, которому каждый раз приходится объяснять контекст, в систему, способную передавать этот контекст дальше. Однако это открывает сценарий сбоя, которого нет в stateless-чат-режиме: интерпретация может стать частью памяти, извлекаться как факт и обосновывать более сильную версию самой себя.

OpenSpec: Отклонённые предложения — конвенция о памяти решений

OpenSpec: Отклонённые предложения — конвенция о памяти решений

Нет состояния отклонения. Вот обходной путь.

Агент, который полгода назад предложил и внедрил «перенос персистентности в общую библиотеку», с удовольствием предложит то же самое в следующем квартале, если только что-то долговечное не сообщит ему, что эта идея уже была исследована и отклонена — а в OpenSpec сегодня нет встроенного состояния для этого.

OpenSpec: быстрая установка, рабочий процесс и частые ошибки

OpenSpec: быстрая установка, рабочий процесс и частые ошибки

Спецификации в виде дельт, а не 40-страничный PRD.

OpenSpec — это бесплатный инструмент командной строки с открытым исходным кодом от Fission AI, который позволяет вам и вашему ИИ-агенту по разработке кода согласовать изменения в формате простого Markdown до начала написания кода, без жесткой фазовой структуры, характерной для более тяжелых спецификационных фреймворков.

Как безопасно выполнить миграцию с OpenClaw на Hermes Agent

Как безопасно выполнить миграцию с OpenClaw на Hermes Agent

Безопасный перевод, выходящий за рамки однострочного импорта

Миграция ИИ-ассистента — это не то же самое, что копирование конфигурации приложения. Сложная часть заключается в сохранении идентичности, памяти, поведения инструментов, запланированных задач и доступа к сообщениям без возникновения ситуации, когда два шлюза (gateway) работают как один и тот же бот.

llama.cpp против Ollama в 2026 году: какой рантайм выбрать?

llama.cpp против Ollama в 2026 году: какой рантайм выбрать?

«Когда llama-server превосходит Ollama»

Ollama и llama.cpp часто сравнивают, будто бы это конкурирующие движки вывода. Настоящий выбор — между управляемым сервисом моделей и набором инструментов, которым вы управляете напрямую.

ROCm и Vulkan для локального запуска LLM на GPU AMD: руководство на 2026 год

ROCm и Vulkan для локального запуска LLM на GPU AMD: руководство на 2026 год

Выберите правильный AMD-бэкенд для каждого движка

ROCm и Vulkan обе ускоряют работу GPU AMD для локального размещения LLM, но они не взаимозаменяемы. Правильный выбор зависит от движка, графического процессора и характера нагрузки.

KV Cache на GPU с 16 ГБ: Как действительно уместить длинный контекст

KV Cache на GPU с 16 ГБ: Как действительно уместить длинный контекст

Почему контекст 128K не работает на 16 ГБ

Модель может заявлять о поддержке контекстного окна в 128K, но проваливаться уже на 40K токенах на видеокарте с 16 ГБ. Архитектурный потолок никогда не обещал, что веса, KV-кэш, вычислительные буферы и системный композитор смогут одновременно уместиться на вашем устройстве.

Что после LLM? Mamba, диффузия и модели мира

Что после LLM? Mamba, диффузия и модели мира

Что последует после LLM? Эпоха посттрансформеров.

Хайп вокруг ИИ следует определённому ритму: примерно раз в три года архитектура, на которую все делают ставку, уступает место чему-то более новому. Следующий сдвиг уже формируется в исследовательских лабораториях.

OpenCode CLI на практике: рабочие процессы, автоматизация и подводные камни

OpenCode CLI на практике: рабочие процессы, автоматизация и подводные камни

«OpenCode из командной строки: на практике»

Командная строка OpenCode разработана для скриптов, CI-конвейеров и автономного запуска агентов. Эта статья представляет собой практическое руководство по её использованию в повседневной работе.

Быстрый старт с Superpowers: установка, рабочий процесс и тестирование

Быстрый старт с Superpowers: установка, рабочий процесс и тестирование

Навыки SDD, устанавливаемые одной командой.

Superpowers упаковывает полноценную спецификационную методологию в устанавливаемые Claude Skills, принуждая к мозговым штурмам, планированию, реализации через субагентов и строгому TDD, вместо того чтобы оставлять структуру на ваше усмотрение.

Обзор агента Pi Coding: минималистичный CLI для AI-кодинга с возможностью кастомизации

Обзор агента Pi Coding: минималистичный CLI для AI-кодинга с возможностью кастомизации

«Небольшой агент для программирования, который требует, чтобы вы его настраивали».

Pi Coding Agent — это минималистичный, открытый терминальный каркас для программирования, который поставляется с четырьмя инструментами по умолчанию и оставляет большую часть поведения на усмотрение расширений, навыков и вашего собственного рабочего процесса.

Гравитация данных: реальная цена API-first подходов в ИИ

Гравитация данных: реальная цена API-first подходов в ИИ

Почему ваш стек ИИ становится всё более «липким» каждый месяц.

Каждый вызов API кажется простой транзакцией — пока их количество не накопится настолько, что ваши данные для тонкой настройки, системы оценки и схемы инструментов не окажутся привязаны к одному вендору, и переключение перестанет быть просто изменением маршрутизации.

Subагенты Claude Code: настройка, конфигурация и сценарии использования

Subагенты Claude Code: настройка, конфигурация и сценарии использования

Делегируйте шумные задачи, сохраняйте контекст чистым.

Большинство сессий Claude Code становятся медленными и загроможденными по одной и той же причине: каждый исследовательский grep, каждый дамп логов и каждое «подождите, я проверю еще один файл» навсегда остаются в основном разговоре.

Ollama и vLLM: когда стоит мигрировать локальный LLM-сервер

Ollama и vLLM: когда стоит мигрировать локальный LLM-сервер

Когда переходить с Ollama на vLLM

Ollama — один из самых простых способов запуска локальной языковой модели, но удобство может скрывать момент, когда локальный эксперимент превращается в общий сервис инференса, требующий лучшего планирования и наблюдаемости.

Синхронизация спецификаций, тестов и кода в разработке ИИ

Синхронизация спецификаций, тестов и кода в разработке ИИ

Не позволяйте AI-агентам отклоняться от спецификаций, тестов и кода.

Агенты ИИ для написания кода быстро выпускают функции, но спецификации, тесты и код незаметно расходятся. Этот гид описывает модель прослеживаемости, маппинг спецификаций на тесты и код, а также проверки CI, которые выявляют расхождения перед слиянием.