Novo LLM Benchmark: refiz todos os testes!
Análise detalhada do novo benchmark de LLMs para código, com testes refeitos e resultados atualizados.
Análise detalhada do novo benchmark de LLMs para código, com testes refeitos e resultados atualizados.
Análise do benchmark do LLM Kimi K3 comparado ao Claude Opus, testando sua capacidade de construir um app completo em Rails 8.
Artigo sobre ai-memory, sistema de memória de longo prazo para agentes de IA, com auto-aprendizado e validação inspirado no Hermes Agent.
Dicas e toolkit de IA do Akita: ferramentas como ai-jail, ai-memory e ai-usagebar para desenvolvedores.
Criação do ai-memory, um sistema de memória open source para agentes de código, após problemas com soluções existentes como agentmemory.
Análise aprofundada sobre memória de agentes IA, incluindo Codex, Claude Code e opencode, com o padrão LLM Wiki de Karpathy e o sistema agentmemory.
Relato de uma imersão de 37 dias em 'vibe coding' usando LLMs e agentes de IA para construir e colocar 8 projetos reais em produção.