LLM Benchmarks: Os últimos Deepseek v4, parem de perguntar
Read OriginalO artigo apresenta a mais recente rodada de benchmarks de LLMs, destacando os novos modelos Deepseek v4 (Flash 0731 e Pro 0813) e comparando-os com outros modelos como Fable 5, Sonnet 5, Opus 5, Kimi K3, GLM 5.3, entre outros. O autor explica que o benchmark mede um recorte específico: programação web fácil em Rails, e alerta que notas próximas não significam superioridade geral. Inclui tabela de ranking com scores, tempos e custos, e discute a obsessão da comunidade com Deepseek, concluindo que esses modelos não se destacam dos demais no teste.
Comments
No comments yet
Be the first to share your thoughts!
Browser Extension
Get instant access to AllDevBlogs from your browser