Fabio Akita 8/22/2026

LLM Benchmarks: Os últimos Deepseek v4, parem de perguntar

Read Original

O artigo apresenta a mais recente rodada de benchmarks de LLMs, destacando os novos modelos Deepseek v4 (Flash 0731 e Pro 0813) e comparando-os com outros modelos como Fable 5, Sonnet 5, Opus 5, Kimi K3, GLM 5.3, entre outros. O autor explica que o benchmark mede um recorte específico: programação web fácil em Rails, e alerta que notas próximas não significam superioridade geral. Inclui tabela de ranking com scores, tempos e custos, e discute a obsessão da comunidade com Deepseek, concluindo que esses modelos não se destacam dos demais no teste.

LLM Benchmarks: Os últimos Deepseek v4, parem de perguntar

Comments

No comments yet

Be the first to share your thoughts!

Browser Extension

Get instant access to AllDevBlogs from your browser