Sobre el proyecto
Sobre el autor
Me llamo Johannes Eva y creo sitios web desde hace veintisiete años. Baremo IA nació para cubrir una carencia: ninguna clasificación medía lo que me interesaba, la calidad de escritura de los modelos de IA en español.
Los benchmarks públicos se centran en el código, las matemáticas y el razonamiento. La pequeña parte que dedican a la escritura casi siempre se evalúa en inglés. Aquí solo importa la calidad de los textos generados. Las consignas se conciben directamente en español y las respuestas se comparan a ciegas.
Los modelos que pueden ejecutarse en casa ocupan un lugar especial. Gemma 4, Qwen 3.6 y Mistral Medium 3.5 son algunas de las familias marcadas con 🏠. Las he ejecutado localmente con varias cuantizaciones.
Este sitio es un proyecto personal. Ningún proveedor de modelos me paga y no tengo ningún interés en favorecer a uno. Los resultados publicados proceden de duelos anónimos.
Hardware
Los ordenadores detrás de los modelos locales
El equipo principal es un Framework Desktop basado en la plataforma Strix Halo de AMD. Su memoria unificada permite probar modelos locales que no caben en una tarjeta gráfica de consumo convencional.
- Ordenador
- Framework Desktop, AMD Ryzen AI Max serie 300, revisión A6
- Procesador
- AMD Ryzen AI Max+ 395, 16 núcleos y 32 hilos, hasta 5,19 GHz
- Gráficos
- AMD Radeon 8060S integrada
- Memoria
- 128 GB de memoria unificada, compartida por el procesador y la unidad gráfica
- Almacenamiento
- SSD NVMe Samsung 9100 PRO de 2 TB y WD_BLACK SN770 de 2 TB
- Segundo equipo
- Otro ordenador con una NVIDIA GeForce RTX 5070 Ti