Llm

gstack: Stack de Engenharia de Software com IA

gstack: Stack de Engenharia de Software com IA

“Uma fábrica de software construída a partir de habilidades de agentes”

Agentes de IA para codificação já conseguem escrever funções, modificar repositórios, executar testes e abrir solicitações de pull request. O problema mais difícil é fazer um agente seguir um processo de engenharia repetível antes, durante e depois da escrita do código.

Loops de Memória Autoreforçantes em Agentes de IA: Causas e Soluções

Loops de Memória Autoreforçantes em Agentes de IA: Causas e Soluções

Quando conclusões lembradas se tornam novas evidências.

A memória persistente transforma um agente de uma ferramenta que precisa ser reexplicada em um que carrega o contexto para frente — mas abre um modo de falha que o chat sem estado evita: uma interpretação pode se tornar memória, recuperada como fato, e justificar uma versão mais forte de si mesma.

Mnemosyne para Hermes Agent: Guia Rápido de Memória Local

Mnemosyne para Hermes Agent: Guia Rápido de Memória Local

Memória local do Hermes com gravações controladas.

Mnemosyne é um provedor de memória local-first para o Hermes Agent, armazenando memória de trabalho, fatos estruturados, dados temporais e história episódica em SQLite local — sem serviço hospedado, sem chamadas de rede obrigatórias e com controle de gravação excepcionalmente granular.

Propostas Rejeitadas do OpenSpec: Uma Convenção de Memória de Decisão

Propostas Rejeitadas do OpenSpec: Uma Convenção de Memória de Decisão

Sem estado de rejeição. Veja a solução alternativa.

Um agente que propôs e implementou “mover a persistência para uma biblioteca compartilhada” há seis meses propô-lo-á novamente no próximo trimestre, a menos que algo durável informe que a ideia já foi investigada e rejeitada — e o OpenSpec não possui estado embutido para isso atualmente.

OpenSpec: Guia Inicial, Instalação, Fluxo de Trabalho e Erros Comuns

OpenSpec: Guia Inicial, Instalação, Fluxo de Trabalho e Erros Comuns

Especificações como diferenças, não como um PRD de 40 páginas.

OpenSpec é uma CLI gratuita e de código aberto da Fission AI que faz com que você e seu agente de codificação concordem sobre uma mudança em Markdown puro antes que qualquer código seja escrito, sem a cerimônia de fases de frameworks mais pesados de desenvolvimento orientado por especificação.

Como migrar do OpenClaw para o Hermes Agent com segurança

Como migrar do OpenClaw para o Hermes Agent com segurança

Um cutover seguro que vai além do import de uma linha

Migrar um assistente de IA não é o mesmo que copiar uma configuração de aplicativo. A parte difícil é preservar identidade, memória, comportamento das ferramentas, trabalhos agendados e acesso a mensagens, sem que dois gateways atuem como o mesmo bot.

KV Cache em GPUs de 16 GB: Tornando o Contexto Longo Realmente Viável

KV Cache em GPUs de 16 GB: Tornando o Contexto Longo Realmente Viável

Por que a contextualização de 128K falha em 16 GB

Um modelo pode anunciar uma janela de contexto de 128K e ainda assim falhar com 40K tokens em uma GPU de 16 GB. O limite arquitetural nunca prometeu que pesos, cache de KV, buffers de computação e o compositor do ambiente gráfico caberiam no seu cartão ao mesmo tempo.

O que vem depois dos LLMs? Mamba, Diffusion e Modelos de Mundo

O que vem depois dos LLMs? Mamba, Diffusion e Modelos de Mundo

O que vem depois dos LLMs? A era pós-transformer.

O hype da IA segue um ritmo: aproximadamente a cada três anos, a arquitetura em que todos apostam é substituída por algo mais novo. A próxima transição já está se formando nos laboratórios de pesquisa.

Revisão do Agente de Codificação Pi: CLI de IA Minimalista e Hackeável

Revisão do Agente de Codificação Pi: CLI de IA Minimalista e Hackeável

Um pequeno agente de programação que espera que você o molde.

O Pi Coding Agent é um harness de codificação minimalista e de código aberto para terminal que é fornecido com quatro ferramentas padrão e deixa a maior parte do comportamento para extensões, habilidades e o seu próprio fluxo de trabalho.

Gravidade de Dados: O Custo Real da IA Prioritária em APIs

Gravidade de Dados: O Custo Real da IA Prioritária em APIs

Por que seu stack de IA fica mais grudento a cada mês.

Cada chamada de API parece uma transação simples — até que uma quantidade suficiente delas se acumule, de modo que seus dados de ajuste fino, seus conjuntos de avaliação e seus esquemas de ferramentas fiquem moldados em torno de um único fornecedor, e a troca deixe de ser apenas uma mudança de roteamento.