LLM Benchmark: Kimi v2.7 code, GLM 5.2, Minimax M3 local
Benchmark de modelos open source de coding: Kimi K2.7 Code, GLM 5.2 e MiniMax M3, com análise de desempenho e contexto sobre data centers.
Fabio Akita is a veteran software engineer, content creator, and tech blogger with decades of experience in programming, Ruby on Rails, and technology career guidance.
77 artigos from this blog
Benchmark de modelos open source de coding: Kimi K2.7 Code, GLM 5.2 e MiniMax M3, com análise de desempenho e contexto sobre data centers.
Artigo técnico sobre como contornar o bloqueio da API do GitHub no Brasil, com testes e soluções para desenvolvedores.
Análise do lançamento do Claude Fable 5 pela Anthropic, com contexto sobre a corrida de LLMs, gargalos de infraestrutura e IPOs.
Exploração do desenvolvimento de TUIs em Rust com Ratatui e Bubble Tea, usando LLMs para gerar código.
Análise da controvérsia sobre uso de IA em contribuições open source, com opinião sobre o futuro e adaptação dos processos.
Atualização de benchmark de LLMs com novos modelos Grok 4.3, MiniMax M3 e Opus 4.8, mantendo o ranking de desempenho em coding.
Guia prático sobre boas práticas essenciais para projetos de código aberto com LLM, focando em instalação, testes e documentação.
Guia técnico para ler mangá do MANGA Plus no desktop, usando engenharia reversa do app Android e ferramentas como Frank Manga+ e Prettify-Manga.
Tutorial de como fazer backup do Gmail para formato Maildir no Linux usando mbsync.
Análise detalhada dos harnesses Oh-My-Pi e OpenCode para coding agents, comparando suas funcionalidades e utilidade prática.
Dicas e toolkit de IA do Akita: ferramentas como ai-jail, ai-memory e ai-usagebar para desenvolvedores.
Widget Waybar em Rust para monitorar uso de planos de LLM (Claude, GPT, Z.AI, OpenRouter) no Omarchy.
Ferramenta CLI em Rust para monitorar issues e PRs abertos em repositórios do GitHub diretamente do terminal.
Criação do ai-memory, um sistema de memória open source para agentes de código, após problemas com soluções existentes como agentmemory.
Análise aprofundada sobre memória de agentes IA, incluindo Codex, Claude Code e opencode, com o padrão LLM Wiki de Karpathy e o sistema agentmemory.
Autor reflete sobre maratona de 500h usando LLMs para codar 100% do tempo, compartilhando resultados e lições.
Análise de benchmarks de LLMs mostrando como destravar o DeepSeek V4 Pro usando DeepClaude, alcançando pontuação Tier A.
Projeto NW-Omarchy traz o visual do Omarchy (Wayland) para o X11 usando XLibre, um fork ativo do xorg-server.
Análise de benchmarks comparando modelo único (Opus 4.7) vs. combinação planejador+executor em coding, com foco em custo e qualidade.
Benchmark de LLMs para coding em maio de 2026, comparando DeepSeek v4, Kimi v2.6, Grok 4.3, GPT 5.5 e outros modelos.