ModelVerdict

Benchmarks independientes de modelos de IA en tareas empresariales

¿Qué modelo puede encargarse de su papeleo, en su idioma, y cuánto le costará realmente?

Cada semana ponemos a modelos comerciales y abiertos ante las mismas tareas empresariales: facturas, correos de clientes, datos personales y contratos, y después resúmenes y preguntas sobre documentos. Cada cifra lleva a la salida real del modelo y a lo que cuesta de verdad, incluida la corrección de sus errores.

Última ejecución 28 de septiembre de 2026 · 10 modelos · documentos: Inglés (EE. UU.), Checo, Alemán

Clasificaciones por tarea

Ordenado por precisión. Los costes ya incluyen el impuesto lingüístico en tokens. Umbral: 95 %.

#ModeloPrecisiónPor cada 1000Impuesto lingüísticoDatos en la UE
1GPT-6 Sol
OpenAI
99,9 %alcanza el umbral
8,88 €×1,00Sí
2Claude Sonnet 5
Anthropic
99,8 %alcanza el umbral
8,13 €×1,00Sí
3Gemini 3.8 Flash
Google
99,8 %alcanza el umbral
3,53 €×1,00No
4GPT-6 Luna
OpenAI
99,7 %alcanza el umbral
0,47 €×1,00Sí
5DeepSeek V4.1 Flash
DeepSeek · pesos abiertos
99,4 %alcanza el umbral
0,48 €×1,00Solo alojamiento propio
6Gemini 3.5 Flash Lite
Google
99,2 %alcanza el umbral
0,80 €×1,00Sí
7Mistral Medium 3.5
Mistral
97,8 %alcanza el umbral
4,02 €×1,00Sí
8Gemma 4 31B
Google · pesos abiertos
97,6 %alcanza el umbral
0,15 €×1,00Solo alojamiento propio
9Mistral Small 4
Mistral · pesos abiertos
95,6 %alcanza el umbral
0,37 €—Sí
10Qwen3.8 Flash
Qwen
82,4 %por debajo del umbral
1,06 €×1,00No

Clasificación completa y filtros →