Rangliste
Wer Ihre Aufgabe am besten erledigt
Sortiert nach dem Anteil richtiger Felder. Die Kosten sind der reale Tokenverbrauch, hochgerechnet auf 1.000 Dokumente. Schwelle: 95 % richtige Felder; darunter kostet die manuelle Korrektur mehr, als ein günstigeres Modell einspart.
Zwei Modelle nebeneinander vergleichen →
Rechnungsextraktion · Tschechisch · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 8,66 € | 0 | 3,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | Gemini 3.8 Flash | 100,0 % | 99 % | 3,92 € | 7 | 3,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,9 % | 99 % | 0,46 € | 13 | 5,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | GPT-6 Sol OpenAI | 99,9 % | 99 % | 9,31 € | 13 | 3,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | Gemini 3.5 Flash Lite | 99,5 % | 93 % | 0,95 € | 67 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 6 | GPT-6 Luna OpenAI | 99,3 % | 93 % | 0,46 € | 67 | 3,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 96,1 % | 67 % | 0,19 € | 333 | 10,4 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Mistral Small 4 Mistral · Open Weights | 93,6 % | 56 % | 0,40 € | 440 | 2,0 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 9 | Mistral Medium 3.5 Mistral | 93,5 % | 63 % | 4,31 € | 367 | 2,6 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Qwen3.8 Flash Qwen | 91,8 % | 77 % | 0,94 € | 233 | 17,0 Sek. | 96,7 % | unter der Schwelle | ungültiges JSON |
Rechnungsextraktion · Tschechisch · PDF-Text (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 4,48 € | 0 | 2,7 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,46 € | 0 | 6,0 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.5 Flash Lite | 100,0 % | 100 % | 0,84 € | 0 | 1,1 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | Gemini 3.8 Flash | 100,0 % | 100 % | 3,18 € | 0 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | — |
| 5 | GPT-6 Luna OpenAI | 100,0 % | 100 % | 0,19 € | 0 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 6 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 3,69 € | 0 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | — |
| 7 | Mistral Medium 3.5 Mistral | 99,8 % | 98 % | 2,73 € | 22 | 1,5 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 8 | Gemma 4 31B Google · Open Weights | 99,5 % | 93 % | 0,22 € | 67 | 9,0 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 9 | Mistral Small 4 Mistral · Open Weights | 96,8 % | 76 % | 0,23 € | 244 | 1,4 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 10 | Qwen3.8 Flash Qwen | 92,0 % | 53 % | 0,68 € | 467 | 19,9 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
Rechnungsextraktion · Tschechisch · Sauberes Bild (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 12,14 € | 0 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,45 € | 0 | 4,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.8 Flash | 100,0 % | 100 % | 4,24 € | 0 | 4,0 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 13,40 € | 0 | 3,9 Sek. | 100,0 % | erreicht die Schwelle | — |
| 5 | GPT-6 Luna OpenAI | 99,7 % | 96 % | 0,67 € | 44 | 3,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | Gemini 3.5 Flash Lite | 99,5 % | 93 % | 0,99 € | 67 | 2,0 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 7 | Gemma 4 31B Google · Open Weights | 95,4 % | 62 % | 0,18 € | 378 | 11,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Qwen3.8 Flash Qwen | 92,7 % | 84 % | 1,02 € | 156 | 15,9 Sek. | 95,6 % | unter der Schwelle | ungültiges JSON |
| 9 | Mistral Small 4 Mistral · Open Weights | 92,3 % | 44 % | 0,47 € | 556 | 1,9 Sek. | 100,0 % | unter der Schwelle | erfundener Wert |
| 10 | Mistral Medium 3.5 Mistral | 92,1 % | 60 % | 4,94 € | 400 | 2,5 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
Rechnungsextraktion · Tschechisch · Scan (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 9,65 € | 0 | 3,7 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | Gemini 3.8 Flash | 99,8 % | 98 % | 4,24 € | 22 | 3,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | GPT-6 Sol OpenAI | 99,8 % | 98 % | 10,94 € | 22 | 4,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,7 % | 96 % | 0,45 € | 44 | 4,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | Gemini 3.5 Flash Lite | 99,0 % | 87 % | 0,99 € | 133 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | GPT-6 Luna OpenAI | 98,3 % | 87 % | 0,54 € | 133 | 3,4 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 94,9 % | 56 % | 0,18 € | 444 | 11,9 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 8 | Mistral Small 4 Mistral · Open Weights | 92,1 % | 47 % | 0,47 € | 533 | 2,6 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 9 | Qwen3.8 Flash Qwen | 90,9 % | 89 % | 1,08 € | 111 | 15,4 Sek. | 93,3 % | unter der Schwelle | ungültiges JSON |
| 10 | Mistral Medium 3.5 Mistral | 89,1 % | 36 % | 4,97 € | 644 | 2,9 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
Rechnungsextraktion · Tschechisch · Foto (15 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 7,77 € | 0 | 3,9 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,49 € | 0 | 5,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.8 Flash | 100,0 % | 100 % | 4,16 € | 0 | 3,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | Gemini 3.5 Flash Lite | 99,5 % | 93 % | 1,03 € | 67 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 5 | GPT-6 Sol OpenAI | 99,5 % | 93 % | 8,98 € | 67 | 4,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | GPT-6 Luna OpenAI | 99,0 % | 87 % | 0,43 € | 133 | 3,3 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Mistral Small 4 Mistral · Open Weights | 92,8 % | 60 % | 0,49 € | 400 | 2,9 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 8 | Gemma 4 31B Google · Open Weights | 91,8 % | 33 % | 0,19 € | 667 | 11,0 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 9 | Mistral Medium 3.5 Mistral | 91,8 % | 53 % | 5,19 € | 467 | 3,0 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Qwen3.8 Flash Qwen | 91,3 % | 87 % | 1,02 € | 133 | 15,4 Sek. | 100,0 % | unter der Schwelle | fehlendes Feld |
Rechnungsextraktion · Deutsch · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.5 Flash Lite | 100,0 % | 100 % | 0,95 € | 0 | 1,5 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | GPT-6 Sol OpenAI | 100,0 % | 99 % | 9,80 € | 7 | 4,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,5 % | 94 % | 0,52 € | 60 | 6,4 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | GPT-6 Luna OpenAI | 99,2 % | 91 % | 0,50 € | 87 | 3,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | Claude Sonnet 5 Anthropic | 99,0 % | 87 % | 9,58 € | 133 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 6 | Mistral Medium 3.5 Mistral | 97,4 % | 75 % | 4,34 € | 253 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 7 | Gemini 3.8 Flash | 97,2 % | 96 % | 6,58 € | 40 | 4,7 Sek. | 97,3 % | erreicht die Schwelle | ungültiges JSON |
| 8 | Gemma 4 31B Google · Open Weights | 94,9 % | 64 % | 0,18 € | 360 | 7,7 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 9 | Mistral Small 4 Mistral · Open Weights | 94,5 % | 49 % | 0,40 € | 508 | 2,0 Sek. | 100,0 % | unter der Schwelle | erfundener Wert |
| 10 | Qwen3.8 Flash Qwen | 93,5 % | 87 % | 1,03 € | 127 | 19,0 Sek. | 94,0 % | unter der Schwelle | ungültiges JSON |
Rechnungsextraktion · Deutsch · PDF-Text (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,45 € | 0 | 6,7 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | Gemini 3.5 Flash Lite | 100,0 % | 100 % | 0,84 € | 0 | 1,1 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | GPT-6 Luna OpenAI | 100,0 % | 100 % | 0,20 € | 0 | 3,0 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 3,54 € | 0 | 3,1 Sek. | 100,0 % | erreicht die Schwelle | — |
| 5 | Qwen3.8 Flash Qwen | 100,0 % | 100 % | 0,91 € | 0 | 27,8 Sek. | 100,0 % | erreicht die Schwelle | — |
| 6 | Gemma 4 31B Google · Open Weights | 99,5 % | 93 % | 0,21 € | 67 | 7,0 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 7 | Mistral Medium 3.5 Mistral | 99,5 % | 93 % | 2,72 € | 67 | 1,4 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 8 | Claude Sonnet 5 Anthropic | 99,3 % | 91 % | 5,42 € | 89 | 3,3 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 9 | Mistral Small 4 Mistral · Open Weights | 97,9 % | 80 % | 0,23 € | 200 | 1,3 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 10 | Gemini 3.8 Flash | 97,8 % | 98 % | 5,74 € | 22 | 3,9 Sek. | 97,8 % | erreicht die Schwelle | ungültiges JSON |
Rechnungsextraktion · Deutsch · Sauberes Bild (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.5 Flash Lite | 100,0 % | 100 % | 0,99 € | 0 | 1,7 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 14,04 € | 0 | 5,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,7 % | 96 % | 0,51 € | 44 | 5,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | GPT-6 Luna OpenAI | 99,7 % | 96 % | 0,71 € | 44 | 4,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | Claude Sonnet 5 Anthropic | 99,0 % | 87 % | 12,21 € | 133 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 6 | Mistral Medium 3.5 Mistral | 96,6 % | 69 % | 5,00 € | 311 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 7 | Gemini 3.8 Flash | 95,2 % | 91 % | 8,10 € | 89 | 5,1 Sek. | 95,6 % | erreicht die Schwelle | ungültiges JSON |
| 8 | Gemma 4 31B Google · Open Weights | 93,9 % | 51 % | 0,17 € | 489 | 7,4 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 9 | Mistral Small 4 Mistral · Open Weights | 93,4 % | 36 % | 0,47 € | 643 | 1,8 Sek. | 100,0 % | unter der Schwelle | erfundener Wert |
| 10 | Qwen3.8 Flash Qwen | 88,4 % | 82 % | 1,16 € | 178 | 16,7 Sek. | 88,9 % | unter der Schwelle | ungültiges JSON |
Rechnungsextraktion · Deutsch · Scan (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.5 Flash Lite | 100,0 % | 100 % | 0,99 € | 0 | 1,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | GPT-6 Sol OpenAI | 99,8 % | 98 % | 12,10 € | 22 | 5,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,0 % | 87 % | 0,56 € | 133 | 7,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | Claude Sonnet 5 Anthropic | 98,6 % | 82 % | 10,93 € | 178 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 5 | GPT-6 Luna OpenAI | 98,3 % | 82 % | 0,61 € | 178 | 4,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | Gemini 3.8 Flash | 97,8 % | 98 % | 6,12 € | 22 | 5,0 Sek. | 97,8 % | erreicht die Schwelle | ungültiges JSON |
| 7 | Mistral Medium 3.5 Mistral | 96,9 % | 67 % | 5,02 € | 333 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | Qwen3.8 Flash Qwen | 96,9 % | 87 % | 1,06 € | 133 | 16,6 Sek. | 97,8 % | erreicht die Schwelle | ungültiges JSON |
| 9 | Mistral Small 4 Mistral · Open Weights | 92,5 % | 33 % | 0,47 € | 667 | 2,4 Sek. | 100,0 % | unter der Schwelle | erfundener Wert |
| 10 | Gemma 4 31B Google · Open Weights | 91,8 % | 51 % | 0,17 € | 489 | 8,7 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
Rechnungsextraktion · Deutsch · Foto (15 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.5 Flash Lite | 100,0 % | 100 % | 1,02 € | 0 | 1,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | Gemini 3.8 Flash | 100,0 % | 100 % | 5,93 € | 0 | 4,8 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 8,95 € | 0 | 5,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,5 % | 93 % | 0,64 € | 67 | 6,4 Sek. | 100,0 % | erreicht die Schwelle | vertauschte Daten |
| 5 | Claude Sonnet 5 Anthropic | 99,0 % | 87 % | 10,17 € | 133 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | GPT-6 Luna OpenAI | 98,5 % | 80 % | 0,46 € | 200 | 3,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Mistral Medium 3.5 Mistral | 94,9 % | 60 % | 5,22 € | 400 | 2,7 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 8 | Mistral Small 4 Mistral · Open Weights | 93,5 % | 46 % | 0,49 € | 539 | 2,5 Sek. | 100,0 % | unter der Schwelle | erfundener Wert |
| 9 | Gemma 4 31B Google · Open Weights | 93,3 % | 53 % | 0,17 € | 467 | 9,1 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Qwen3.8 Flash Qwen | 79,0 % | 67 % | 0,91 € | 333 | 15,6 Sek. | 80,0 % | unter der Schwelle | ungültiges JSON |
Rechnungsextraktion · Englisch (USA) · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | GPT-6 Sol OpenAI | 99,9 % | 99 % | 8,88 € | 7 | 4,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 2 | Claude Sonnet 5 Anthropic | 99,8 % | 99 % | 8,13 € | 13 | 3,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | Gemini 3.8 Flash | 99,8 % | 98 % | 3,53 € | 20 | 3,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | GPT-6 Luna OpenAI | 99,7 % | 97 % | 0,47 € | 33 | 3,4 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 5 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,4 % | 93 % | 0,48 € | 67 | 5,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | Gemini 3.5 Flash Lite | 99,2 % | 92 % | 0,80 € | 80 | 1,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Mistral Medium 3.5 Mistral | 97,8 % | 79 % | 4,02 € | 207 | 2,3 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Gemma 4 31B Google · Open Weights | 97,6 % | 81 % | 0,15 € | 187 | 8,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Mistral Small 4 Mistral · Open Weights | 95,6 % | 58 % | 0,37 € | 420 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Steuersatz |
| 10 | Qwen3.8 Flash Qwen | 82,4 % | 57 % | 1,06 € | 427 | 17,4 Sek. | 90,7 % | unter der Schwelle | ungültiges JSON |
Rechnungsextraktion · Englisch (USA) · PDF-Text (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,47 € | 0 | 7,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | Gemini 3.8 Flash | 100,0 % | 100 % | 2,69 € | 0 | 2,3 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemma 4 31B Google · Open Weights | 100,0 % | 100 % | 0,17 € | 0 | 7,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | GPT-6 Luna OpenAI | 100,0 % | 100 % | 0,17 € | 0 | 2,7 Sek. | 100,0 % | erreicht die Schwelle | — |
| 5 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 3,02 € | 0 | 3,2 Sek. | 100,0 % | erreicht die Schwelle | — |
| 6 | Claude Sonnet 5 Anthropic | 99,8 % | 98 % | 3,60 € | 22 | 2,4 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 7 | Mistral Medium 3.5 Mistral | 99,8 % | 98 % | 2,06 € | 22 | 1,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Gemini 3.5 Flash Lite | 99,4 % | 96 % | 0,66 € | 44 | 1,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Mistral Small 4 Mistral · Open Weights | 98,4 % | 84 % | 0,17 € | 156 | 1,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 10 | Qwen3.8 Flash Qwen | 91,7 % | 49 % | 0,89 € | 511 | 18,7 Sek. | 100,0 % | unter der Schwelle | falscher Steuersatz |
Rechnungsextraktion · Englisch (USA) · Sauberes Bild (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 11,21 € | 0 | 3,3 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 12,70 € | 0 | 4,2 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.5 Flash Lite | 99,6 % | 96 % | 0,85 € | 44 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 4 | Gemini 3.8 Flash | 99,6 % | 96 % | 3,80 € | 44 | 3,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | GPT-6 Luna OpenAI | 99,6 % | 96 % | 0,67 € | 44 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 6 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,2 % | 91 % | 0,46 € | 89 | 4,6 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 7 | Gemma 4 31B Google · Open Weights | 98,2 % | 84 % | 0,15 € | 156 | 9,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Mistral Medium 3.5 Mistral | 98,0 % | 82 % | 4,83 € | 178 | 2,3 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Mistral Small 4 Mistral · Open Weights | 95,6 % | 56 % | 0,46 € | 444 | 1,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Steuersatz |
| 10 | Qwen3.8 Flash Qwen | 77,2 % | 60 % | 1,04 € | 400 | 15,2 Sek. | 86,7 % | unter der Schwelle | ungültiges JSON |
Rechnungsextraktion · Englisch (USA) · Scan (45 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 9,80 € | 0 | 3,3 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 11,08 € | 0 | 4,3 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.8 Flash | 99,8 % | 98 % | 4,01 € | 22 | 3,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | GPT-6 Luna OpenAI | 99,6 % | 96 % | 0,58 € | 44 | 3,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,0 % | 89 % | 0,50 € | 111 | 5,4 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | Gemini 3.5 Flash Lite | 98,8 % | 87 % | 0,86 € | 133 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 7 | Gemma 4 31B Google · Open Weights | 96,6 % | 73 % | 0,15 € | 267 | 9,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Mistral Medium 3.5 Mistral | 96,0 % | 62 % | 4,85 € | 378 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Mistral Small 4 Mistral · Open Weights | 93,5 % | 38 % | 0,46 € | 622 | 2,3 Sek. | 100,0 % | unter der Schwelle | falscher Steuersatz |
| 10 | Qwen3.8 Flash Qwen | 81,4 % | 60 % | 1,24 € | 400 | 17,4 Sek. | 91,1 % | unter der Schwelle | ungültiges JSON |
Rechnungsextraktion · Englisch (USA) · Foto (15 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.8 Flash | 100,0 % | 100 % | 3,80 € | 0 | 3,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,4 % | 93 % | 0,48 € | 67 | 5,3 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | GPT-6 Luna OpenAI | 99,4 % | 93 % | 0,44 € | 67 | 3,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | GPT-6 Sol OpenAI | 99,4 % | 93 % | 8,35 € | 67 | 4,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | Claude Sonnet 5 Anthropic | 98,8 % | 93 % | 7,44 € | 67 | 3,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | Gemini 3.5 Flash Lite | 98,8 % | 87 % | 0,86 € | 133 | 1,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Mistral Medium 3.5 Mistral | 96,4 % | 67 % | 5,00 € | 333 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Mistral Small 4 Mistral · Open Weights | 93,3 % | 47 % | 0,47 € | 533 | 2,6 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 9 | Gemma 4 31B Google · Open Weights | 92,1 % | 40 % | 0,15 € | 600 | 10,4 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Qwen3.8 Flash Qwen | 72,7 % | 67 % | 1,10 € | 333 | 19,6 Sek. | 73,3 % | unter der Schwelle | ungültiges JSON |
E-Mail-Triage · Tschechisch · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.8 Flash | 99,2 % | 93 % | 2,82 € | 73 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 2 | GPT-6 Sol OpenAI | 99,0 % | 91 % | 2,94 € | 93 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | Qwen3.8 Flash Qwen | 98,5 % | 87 % | 0,41 € | 133 | 13,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | Claude Sonnet 5 Anthropic | 98,2 % | 83 % | 4,52 € | 167 | 4,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | GPT-6 Luna OpenAI | 97,9 % | 81 % | 0,16 € | 187 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 97,4 % | 77 % | 0,27 € | 227 | 4,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 97,1 % | 75 % | 0,15 € | 253 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Gemini 3.5 Flash Lite | 95,8 % | 64 % | 0,47 € | 360 | 0,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Mistral Medium 3.5 Mistral | 94,5 % | 55 % | 1,79 € | 447 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 87,7 % | 32 % | 0,11 € | 685 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
E-Mail-Triage · Tschechisch · E-Mail (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.8 Flash | 99,2 % | 93 % | 2,82 € | 73 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 2 | GPT-6 Sol OpenAI | 99,0 % | 91 % | 2,94 € | 93 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | Qwen3.8 Flash Qwen | 98,5 % | 87 % | 0,41 € | 133 | 13,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | Claude Sonnet 5 Anthropic | 98,2 % | 83 % | 4,52 € | 167 | 4,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | GPT-6 Luna OpenAI | 97,9 % | 81 % | 0,16 € | 187 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 97,4 % | 77 % | 0,27 € | 227 | 4,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 97,1 % | 75 % | 0,15 € | 253 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Gemini 3.5 Flash Lite | 95,8 % | 64 % | 0,47 € | 360 | 0,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Mistral Medium 3.5 Mistral | 94,5 % | 55 % | 1,79 € | 447 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 87,7 % | 32 % | 0,11 € | 685 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
E-Mail-Triage · Deutsch · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.8 Flash | 98,4 % | 85 % | 2,52 € | 147 | 2,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 2 | GPT-6 Sol OpenAI | 98,2 % | 84 % | 2,51 € | 160 | 2,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | Claude Sonnet 5 Anthropic | 97,9 % | 81 % | 4,70 € | 187 | 4,3 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | Qwen3.8 Flash Qwen | 97,9 % | 81 % | 0,36 € | 187 | 12,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | GPT-6 Luna OpenAI | 97,0 % | 73 % | 0,14 € | 273 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 96,3 % | 68 % | 0,28 € | 324 | 4,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 95,1 % | 62 % | 0,14 € | 380 | 3,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Gemini 3.5 Flash Lite | 94,7 % | 57 % | 0,44 € | 433 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 9 | Mistral Medium 3.5 Mistral | 92,7 % | 48 % | 1,63 € | 520 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 87,1 % | 29 % | 0,10 € | 706 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
E-Mail-Triage · Deutsch · E-Mail (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.8 Flash | 98,4 % | 85 % | 2,52 € | 147 | 2,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 2 | GPT-6 Sol OpenAI | 98,2 % | 84 % | 2,51 € | 160 | 2,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | Claude Sonnet 5 Anthropic | 97,9 % | 81 % | 4,70 € | 187 | 4,3 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | Qwen3.8 Flash Qwen | 97,9 % | 81 % | 0,36 € | 187 | 12,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | GPT-6 Luna OpenAI | 97,0 % | 73 % | 0,14 € | 273 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 96,3 % | 68 % | 0,28 € | 324 | 4,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 95,1 % | 62 % | 0,14 € | 380 | 3,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Gemini 3.5 Flash Lite | 94,7 % | 57 % | 0,44 € | 433 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 9 | Mistral Medium 3.5 Mistral | 92,7 % | 48 % | 1,63 € | 520 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 87,1 % | 29 % | 0,10 € | 706 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
E-Mail-Triage · Englisch (USA) · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | GPT-6 Sol OpenAI | 99,0 % | 92 % | 2,24 € | 80 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 2 | Gemini 3.8 Flash | 98,7 % | 89 % | 2,19 € | 113 | 2,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | Claude Sonnet 5 Anthropic | 98,2 % | 84 % | 3,69 € | 160 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 97,6 % | 79 % | 0,21 € | 213 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | GPT-6 Luna OpenAI | 97,5 % | 77 % | 0,12 € | 227 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | Qwen3.8 Flash Qwen | 97,5 % | 79 % | 0,28 € | 213 | 8,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 96,5 % | 72 % | 0,11 € | 280 | 2,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Gemini 3.5 Flash Lite | 96,3 % | 69 % | 0,39 € | 313 | 0,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Mistral Medium 3.5 Mistral | 94,9 % | 57 % | 1,36 € | 427 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 89,7 % | 37 % | 0,09 € | 627 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
E-Mail-Triage · Englisch (USA) · E-Mail (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | GPT-6 Sol OpenAI | 99,0 % | 92 % | 2,24 € | 80 | 2,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 2 | Gemini 3.8 Flash | 98,7 % | 89 % | 2,19 € | 113 | 2,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 3 | Claude Sonnet 5 Anthropic | 98,2 % | 84 % | 3,69 € | 160 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 4 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 97,6 % | 79 % | 0,21 € | 213 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | GPT-6 Luna OpenAI | 97,5 % | 77 % | 0,12 € | 227 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | Qwen3.8 Flash Qwen | 97,5 % | 79 % | 0,28 € | 213 | 8,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 96,5 % | 72 % | 0,11 € | 280 | 2,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Gemini 3.5 Flash Lite | 96,3 % | 69 % | 0,39 € | 313 | 0,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Mistral Medium 3.5 Mistral | 94,9 % | 57 % | 1,36 € | 427 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 89,7 % | 37 % | 0,09 € | 627 | 0,8 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
Vertragsklauseln · Tschechisch · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 5,57 € | 0 | 3,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,39 € | 0 | 4,3 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.8 Flash | 100,0 % | 100 % | 2,84 € | 0 | 2,2 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | Mistral Medium 3.5 Mistral | 100,0 % | 100 % | 2,81 € | 0 | 1,2 Sek. | 100,0 % | erreicht die Schwelle | — |
| 5 | GPT-6 Luna OpenAI | 100,0 % | 100 % | 0,25 € | 0 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 6 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 4,25 € | 0 | 2,0 Sek. | 100,0 % | erreicht die Schwelle | — |
| 7 | Gemma 4 31B Google · Open Weights | 100,0 % | 99 % | 0,23 € | 7 | 6,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Qwen3.8 Flash Qwen | 99,9 % | 99 % | 0,58 € | 13 | 13,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Gemini 3.5 Flash Lite | 99,9 % | 98 % | 0,78 € | 20 | 0,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 99,0 % | 92 % | 0,21 € | 80 | 1,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
Vertragsklauseln · Tschechisch · Vertragstext (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 5,57 € | 0 | 3,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,39 € | 0 | 4,3 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.8 Flash | 100,0 % | 100 % | 2,84 € | 0 | 2,2 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | Mistral Medium 3.5 Mistral | 100,0 % | 100 % | 2,81 € | 0 | 1,2 Sek. | 100,0 % | erreicht die Schwelle | — |
| 5 | GPT-6 Luna OpenAI | 100,0 % | 100 % | 0,25 € | 0 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | — |
| 6 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 4,25 € | 0 | 2,0 Sek. | 100,0 % | erreicht die Schwelle | — |
| 7 | Gemma 4 31B Google · Open Weights | 100,0 % | 99 % | 0,23 € | 7 | 6,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Qwen3.8 Flash Qwen | 99,9 % | 99 % | 0,58 € | 13 | 13,6 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Gemini 3.5 Flash Lite | 99,9 % | 98 % | 0,78 € | 20 | 0,9 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 99,0 % | 92 % | 0,21 € | 80 | 1,2 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
Vertragsklauseln · Deutsch · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | GPT-6 Luna OpenAI | 100,0 % | 100 % | 0,24 € | 0 | 3,0 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 4,01 € | 0 | 2,9 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.8 Flash | 99,9 % | 99 % | 3,14 € | 7 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 4 | Claude Sonnet 5 Anthropic | 98,2 % | 87 % | 6,54 € | 133 | 4,3 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 5 | Gemini 3.5 Flash Lite | 98,0 % | 84 % | 0,73 € | 160 | 1,0 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 6 | Qwen3.8 Flash Qwen | 98,0 % | 87 % | 0,72 € | 127 | 19,7 Sek. | 99,3 % | erreicht die Schwelle | erfundener Wert |
| 7 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 97,2 % | 77 % | 0,47 € | 228 | 4,6 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | Mistral Medium 3.5 Mistral | 97,1 % | 75 % | 2,54 € | 247 | 1,2 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 9 | Gemma 4 31B Google · Open Weights | 94,4 % | 27 % | 0,20 € | 727 | 2,6 Sek. | 100,0 % | unter der Schwelle | Zahlenformat |
| 10 | Mistral Small 4 Mistral · Open Weights | 94,0 % | 45 % | 0,19 € | 553 | 1,2 Sek. | 100,0 % | unter der Schwelle | erfundener Wert |
Vertragsklauseln · Deutsch · Vertragstext (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | GPT-6 Luna OpenAI | 100,0 % | 100 % | 0,24 € | 0 | 3,0 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 4,01 € | 0 | 2,9 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | Gemini 3.8 Flash | 99,9 % | 99 % | 3,14 € | 7 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 4 | Claude Sonnet 5 Anthropic | 98,2 % | 87 % | 6,54 € | 133 | 4,3 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 5 | Gemini 3.5 Flash Lite | 98,0 % | 84 % | 0,73 € | 160 | 1,0 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 6 | Qwen3.8 Flash Qwen | 98,0 % | 87 % | 0,72 € | 127 | 19,7 Sek. | 99,3 % | erreicht die Schwelle | erfundener Wert |
| 7 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 97,2 % | 77 % | 0,47 € | 228 | 4,6 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | Mistral Medium 3.5 Mistral | 97,1 % | 75 % | 2,54 € | 247 | 1,2 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 9 | Gemma 4 31B Google · Open Weights | 94,4 % | 27 % | 0,20 € | 727 | 2,6 Sek. | 100,0 % | unter der Schwelle | Zahlenformat |
| 10 | Mistral Small 4 Mistral · Open Weights | 94,0 % | 45 % | 0,19 € | 553 | 1,2 Sek. | 100,0 % | unter der Schwelle | erfundener Wert |
Vertragsklauseln · Englisch (USA) · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 4,64 € | 0 | 3,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,29 € | 0 | 3,9 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 3,06 € | 0 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | Gemini 3.5 Flash Lite | 100,0 % | 99 % | 0,64 € | 7 | 1,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | Gemini 3.8 Flash | 99,9 % | 99 % | 2,27 € | 7 | 2,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | GPT-6 Luna OpenAI | 99,8 % | 99 % | 0,18 € | 13 | 2,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 99,6 % | 97 % | 0,17 € | 27 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Mistral Medium 3.5 Mistral | 98,1 % | 87 % | 2,16 € | 127 | 1,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Qwen3.8 Flash Qwen | 95,1 % | 69 % | 0,57 € | 307 | 14,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 91,5 % | 43 % | 0,16 € | 567 | 1,1 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
Vertragsklauseln · Englisch (USA) · Vertragstext (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Sonnet 5 Anthropic | 100,0 % | 100 % | 4,64 € | 0 | 3,4 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 100,0 % | 100 % | 0,29 € | 0 | 3,9 Sek. | 100,0 % | erreicht die Schwelle | — |
| 3 | GPT-6 Sol OpenAI | 100,0 % | 100 % | 3,06 € | 0 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | — |
| 4 | Gemini 3.5 Flash Lite | 100,0 % | 99 % | 0,64 € | 7 | 1,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 5 | Gemini 3.8 Flash | 99,9 % | 99 % | 2,27 € | 7 | 2,0 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 6 | GPT-6 Luna OpenAI | 99,8 % | 99 % | 0,18 € | 13 | 2,7 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 7 | Gemma 4 31B Google · Open Weights | 99,6 % | 97 % | 0,17 € | 27 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 8 | Mistral Medium 3.5 Mistral | 98,1 % | 87 % | 2,16 € | 127 | 1,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 9 | Qwen3.8 Flash Qwen | 95,1 % | 69 % | 0,57 € | 307 | 14,1 Sek. | 100,0 % | erreicht die Schwelle | falscher Wert |
| 10 | Mistral Small 4 Mistral · Open Weights | 91,5 % | 43 % | 0,16 € | 567 | 1,1 Sek. | 100,0 % | unter der Schwelle | falscher Wert |
Erkennung personenbezogener Daten · Tschechisch · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemma 4 31B Google · Open Weights | 99,8 % | 99 % | 0,11 € | 13 | 2,9 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 2 | Mistral Medium 3.5 Mistral | 99,8 % | 99 % | 1,29 € | 13 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 3 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,7 % | 98 % | 0,29 € | 20 | 4,2 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 4 | GPT-6 Sol OpenAI | 99,7 % | 98 % | 2,04 € | 20 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 5 | GPT-6 Luna OpenAI | 99,6 % | 97 % | 0,11 € | 27 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 6 | Gemini 3.8 Flash | 99,5 % | 97 % | 2,01 € | 33 | 2,0 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 7 | Claude Sonnet 5 Anthropic | 98,9 % | 92 % | 3,73 € | 80 | 3,2 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | Mistral Small 4 Mistral · Open Weights | 98,8 % | 92 % | 0,09 € | 81 | 0,9 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 9 | Gemini 3.5 Flash Lite | 98,1 % | 88 % | 0,42 € | 120 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 10 | Qwen3.8 Flash Qwen | 97,0 % | 89 % | 0,37 € | 113 | 9,6 Sek. | 99,3 % | erreicht die Schwelle | falscher Wert |
Erkennung personenbezogener Daten · Tschechisch · Text (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemma 4 31B Google · Open Weights | 99,8 % | 99 % | 0,11 € | 13 | 2,9 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 2 | Mistral Medium 3.5 Mistral | 99,8 % | 99 % | 1,29 € | 13 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 3 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,7 % | 98 % | 0,29 € | 20 | 4,2 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 4 | GPT-6 Sol OpenAI | 99,7 % | 98 % | 2,04 € | 20 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 5 | GPT-6 Luna OpenAI | 99,6 % | 97 % | 0,11 € | 27 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 6 | Gemini 3.8 Flash | 99,5 % | 97 % | 2,01 € | 33 | 2,0 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 7 | Claude Sonnet 5 Anthropic | 98,9 % | 92 % | 3,73 € | 80 | 3,2 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | Mistral Small 4 Mistral · Open Weights | 98,8 % | 92 % | 0,09 € | 81 | 0,9 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 9 | Gemini 3.5 Flash Lite | 98,1 % | 88 % | 0,42 € | 120 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 10 | Qwen3.8 Flash Qwen | 97,0 % | 89 % | 0,37 € | 113 | 9,6 Sek. | 99,3 % | erreicht die Schwelle | falscher Wert |
Erkennung personenbezogener Daten · Deutsch · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Mistral Medium 3.5 Mistral | 100,0 % | 100 % | 1,27 € | 0 | 0,9 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | Gemma 4 31B Google · Open Weights | 99,9 % | 99 % | 0,09 € | 7 | 1,9 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 3 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,8 % | 99 % | 0,28 € | 13 | 3,7 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 4 | Claude Sonnet 5 Anthropic | 99,7 % | 98 % | 4,05 € | 20 | 3,7 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 5 | Gemini 3.8 Flash | 99,7 % | 98 % | 1,95 € | 20 | 2,3 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 6 | GPT-6 Sol OpenAI | 99,7 % | 98 % | 1,96 € | 20 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 7 | Gemini 3.5 Flash Lite | 99,6 % | 97 % | 0,42 € | 27 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | GPT-6 Luna OpenAI | 99,6 % | 97 % | 0,11 € | 27 | 2,2 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 9 | Qwen3.8 Flash Qwen | 99,6 % | 99 % | 0,33 € | 7 | 12,2 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 10 | Mistral Small 4 Mistral · Open Weights | 99,1 % | 94 % | 0,08 € | 65 | 0,9 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
Erkennung personenbezogener Daten · Deutsch · Text (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Mistral Medium 3.5 Mistral | 100,0 % | 100 % | 1,27 € | 0 | 0,9 Sek. | 100,0 % | erreicht die Schwelle | — |
| 2 | Gemma 4 31B Google · Open Weights | 99,9 % | 99 % | 0,09 € | 7 | 1,9 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 3 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,8 % | 99 % | 0,28 € | 13 | 3,7 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 4 | Claude Sonnet 5 Anthropic | 99,7 % | 98 % | 4,05 € | 20 | 3,7 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 5 | Gemini 3.8 Flash | 99,7 % | 98 % | 1,95 € | 20 | 2,3 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 6 | GPT-6 Sol OpenAI | 99,7 % | 98 % | 1,96 € | 20 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 7 | Gemini 3.5 Flash Lite | 99,6 % | 97 % | 0,42 € | 27 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | GPT-6 Luna OpenAI | 99,6 % | 97 % | 0,11 € | 27 | 2,2 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 9 | Qwen3.8 Flash Qwen | 99,6 % | 99 % | 0,33 € | 7 | 12,2 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 10 | Mistral Small 4 Mistral · Open Weights | 99,1 % | 94 % | 0,08 € | 65 | 0,9 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
Erkennung personenbezogener Daten · Englisch (USA) · Alle Stufen (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemma 4 31B Google · Open Weights | 99,9 % | 99 % | 0,08 € | 7 | 2,4 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 2 | Claude Sonnet 5 Anthropic | 99,7 % | 98 % | 3,22 € | 20 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 3 | Gemini 3.8 Flash | 99,7 % | 98 % | 1,71 € | 20 | 1,9 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 4 | Mistral Medium 3.5 Mistral | 99,7 % | 98 % | 1,06 € | 20 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 5 | GPT-6 Sol OpenAI | 99,7 % | 98 % | 1,92 € | 20 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 6 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,6 % | 97 % | 0,26 € | 27 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 7 | GPT-6 Luna OpenAI | 99,6 % | 97 % | 0,10 € | 27 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | Gemini 3.5 Flash Lite | 99,5 % | 97 % | 0,37 € | 27 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 9 | Mistral Small 4 Mistral · Open Weights | 99,4 % | 96 % | 0,07 € | 40 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 10 | Qwen3.8 Flash Qwen | 99,2 % | 99 % | 0,26 € | 13 | 7,5 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
Erkennung personenbezogener Daten · Englisch (USA) · Text (150 Dokumente)
| # | Modell | Richtige Felder | Fehlerfreie Dokumente | Pro 1.000 Dokumente | Zu korrigieren / 1.000 | Tempo (Median) | Gültige Antworten | Schwelle | Häufigster Fehler |
|---|---|---|---|---|---|---|---|---|---|
| 1 | Gemma 4 31B Google · Open Weights | 99,9 % | 99 % | 0,08 € | 7 | 2,4 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 2 | Claude Sonnet 5 Anthropic | 99,7 % | 98 % | 3,22 € | 20 | 2,5 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 3 | Gemini 3.8 Flash | 99,7 % | 98 % | 1,71 € | 20 | 1,9 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 4 | Mistral Medium 3.5 Mistral | 99,7 % | 98 % | 1,06 € | 20 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 5 | GPT-6 Sol OpenAI | 99,7 % | 98 % | 1,92 € | 20 | 2,6 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 6 | DeepSeek V4.1 Flash DeepSeek · Open Weights | 99,6 % | 97 % | 0,26 € | 27 | 3,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 7 | GPT-6 Luna OpenAI | 99,6 % | 97 % | 0,10 € | 27 | 1,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 8 | Gemini 3.5 Flash Lite | 99,5 % | 97 % | 0,37 € | 27 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | fehlendes Feld |
| 9 | Mistral Small 4 Mistral · Open Weights | 99,4 % | 96 % | 0,07 € | 40 | 0,8 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |
| 10 | Qwen3.8 Flash Qwen | 99,2 % | 99 % | 0,26 € | 13 | 7,5 Sek. | 100,0 % | erreicht die Schwelle | erfundener Wert |