ModelVerdict

Brecha lingüística

Brecha lingüística: cuánto empeora un modelo fuera del inglés

Mismo tipo de facturas, mismas instrucciones, distinto idioma. La brecha muestra cuánta precisión pierde un modelo con documentos en otro idioma frente a los documentos en inglés.

ModeloCampos correctos 82 % – 100 %InglésAlemánBrechaDocumentos sin errores (Alemán / Inglés)
Qwen3.8 Flash
Qwen
82,4 %93,4 %+11,0 p. p.87 % / 57 %
Qwen3.8 Flash
Qwen
82,4 %91,3 %+9,0 p. p.77 % / 57 %
Qwen3.8 Flash
Qwen
82,4 %90,5 %+8,1 p. p.82 % / 57 %
Qwen3.8 Flash
Qwen
82,4 %88,2 %+5,8 p. p.78 % / 57 %
Mistral Small 4
Mistral
95,6 %97,5 %+1,9 p. p.77 % / 58 %
Gemini 3.5 Flash Lite
Google
99,2 %100,0 %+0,8 p. p.100 % / 92 %
DeepSeek V4.1 Flash
DeepSeek
99,4 %99,9 %+0,5 p. p.99 % / 93 %
Gemini 3.5 Flash Lite
Google
99,2 %99,6 %+0,4 p. p.96 % / 92 %
Mistral Medium 3.5
Mistral
97,8 %98,1 %+0,4 p. p.81 % / 79 %
Mistral Medium 3.5
Mistral
97,8 %98,0 %+0,2 p. p.83 % / 79 %
DeepSeek V4.1 Flash
DeepSeek
99,4 %99,6 %+0,2 p. p.95 % / 93 %
Claude Sonnet 5
Anthropic
99,8 %100,0 %+0,2 p. p.100 % / 99 %
Gemini 3.5 Flash Lite
Google
99,2 %99,4 %+0,2 p. p.93 % / 92 %
Gemini 3.8 Flash
Google
99,8 %99,9 %+0,1 p. p.99 % / 98 %
Gemini 3.8 Flash
Google
99,8 %99,9 %+0,1 p. p.99 % / 98 %
DeepSeek V4.1 Flash
DeepSeek
99,4 %99,4 %−0,0 p. p.93 % / 93 %
GPT-6 Sol
OpenAI
99,9 %99,9 %−0,0 p. p.99 % / 99 %
GPT-6 Sol
OpenAI
99,9 %99,9 %−0,0 p. p.99 % / 99 %
GPT-6 Sol
OpenAI
99,9 %99,9 %−0,1 p. p.99 % / 99 %
Mistral Medium 3.5
Mistral
97,8 %97,6 %−0,1 p. p.75 % / 79 %
Mistral Small 4
Mistral
95,6 %95,4 %−0,2 p. p.56 % / 58 %
Mistral Small 4
Mistral
95,6 %95,2 %−0,4 p. p.65 % / 58 %
GPT-6 Luna
OpenAI
99,7 %99,3 %−0,4 p. p.94 % / 97 %
GPT-6 Luna
OpenAI
99,7 %99,2 %−0,5 p. p.91 % / 97 %
Gemini 3.5 Flash Lite
Google
99,2 %98,6 %−0,6 p. p.85 % / 92 %
GPT-6 Luna
OpenAI
99,7 %98,9 %−0,8 p. p.88 % / 97 %
GPT-6 Luna
OpenAI
99,7 %98,9 %−0,8 p. p.88 % / 97 %
GPT-6 Sol
OpenAI
99,9 %99,0 %−0,9 p. p.89 % / 99 %
Claude Sonnet 5
Anthropic
99,8 %98,8 %−1,0 p. p.87 % / 99 %
Mistral Small 4
Mistral
95,6 %94,5 %−1,1 p. p.53 % / 58 %
Claude Sonnet 5
Anthropic
99,8 %98,6 %−1,2 p. p.96 % / 99 %
DeepSeek V4.1 Flash
DeepSeek
99,4 %98,0 %−1,3 p. p.78 % / 93 %
Gemma 4 31B
Google
97,6 %96,1 %−1,5 p. p.67 % / 81 %
Gemma 4 31B
Google
97,6 %95,2 %−2,4 p. p.67 % / 81 %
Gemini 3.8 Flash
Google
99,8 %97,3 %−2,5 p. p.97 % / 98 %
Mistral Medium 3.5
Mistral
97,8 %94,9 %−2,9 p. p.67 % / 79 %
Gemma 4 31B
Google
97,6 %94,7 %−3,0 p. p.54 % / 81 %
Gemini 3.8 Flash
Google
99,8 %95,9 %−3,9 p. p.95 % / 98 %
Gemma 4 31B
Google
97,6 %93,3 %−4,3 p. p.52 % / 81 %
Claude Sonnet 5
Anthropic
99,8 %93,4 %−6,5 p. p.77 % / 99 %

Solo se comparan los campos presentes en ambas versiones del documento (Proveedor, ID del proveedor (EIN, IČO…), Número de factura, Referencia de pago, Fecha de factura, Fecha de vencimiento, Base imponible por tipo, Impuesto por tipo, Total, Moneda, Cuenta bancaria). Las facturas estadounidenses no tienen número de IVA ni fecha de devengo, por lo que esos campos quedan fuera.