tag
#benchmark
13 posts
- Kimi K3, ¿vale la pena? Depende de cómo lo pagas [2026] 20 jul 2026
- Burbuja de la IA: por qué ahora creo que sí la hay [2026] 15 jul 2026
- Kimi K2: medí 4 variantes y la más vieja gana [2026] 16 jun 2026
- GLM-5.1: el open source del hype, medido [2026] 15 jun 2026
- Qwen3-Coder-Next: análisis con benchmark propio [2026] 14 jun 2026
- DeepSeek V4 Flash: 800K de contexto real, medido [2026] 13 jun 2026
- Claude Fable 5: análisis con benchmark propio [2026] 12 jun 2026
- Devstral Small: análisis con benchmark propio de 98 modelos [2026] 12 jun 2026
- Probé Fable 5, el modelo más caro de Anthropic, contra Opus 4.8 10 jun 2026
- Benchmark de Modelos AI para Agentes (OpenClaw, N8N) — Abril 2026 11 abr 2026
- MiniMax M2.7 vs Claude Sonnet: Lo Probé en Mis Casos de Uso Reales y los Resultados Me Sorprendieron 22 mar 2026
- Los modelos de IA que realmente uso en marzo 2026 (y por qué cambié todo) 5 mar 2026
- Mejores Modelos de IA 2026: Benchmark Propio en Español 3 feb 2026