Ornith-1.0-35B-GGUF
KNOWNTechnische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
Alle bekannten Varianten dieser Familie. Ein direkter Artikel-Link springt exakt zur genannten Variante.
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
| Benchmark | Wert | Beleg |
|---|---|---|
| harborframework/terminal-bench-2.1Score | 85.2 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsClaude Code 2.1.126 harness, parser=json, temperature=1.0, top_p=1.0, max_new_tokens=131072, avg of 5 runs. |
| harborframework/terminal-bench-2.1Score | 86.1 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsTerminus-2 harness (Harbor framework), parser=json, temperature=1.0, top_p=1.0, 128K context, 4h timeout, avg of 5 runs. |
| SWE-bench/SWE-bench_MultilingualScore | 79.6 | Quelle ↗Community · abgerufen 2026-10-10 |
| datacurve/deep-sweScore | 56 | Quelle ↗Community · abgerufen 2026-10-10 |
| ScaleAI/SWE-bench_ProScore | 65.1 | Quelle ↗Community · abgerufen 2026-10-10 |
| Benchmark | Wert | Beleg |
|---|---|---|
| SWE-bench/SWE-bench_VerifiedScore | 86 | Quelle ↗Community · abgerufen 2026-10-10 |
| cais/hleScore | 56.1 | Quelle ↗Community · abgerufen 2026-10-10TestdetailsWith tools. |
| cais/hleScore | 44.6 | Quelle ↗Community · abgerufen 2026-10-10TestdetailsNo tools. |
| Idavidrein/gpqaScore | 92.8 | Quelle ↗Community · abgerufen 2026-10-10 |
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
| Benchmark | Wert | Beleg |
|---|---|---|
| SWE-bench/SWE-bench_MultilingualScore | 71.4 | Quelle ↗Community · abgerufen 2026-10-10 |
| datacurve/deep-sweScore | 22 | Quelle ↗Community · abgerufen 2026-10-10 |
| ScaleAI/SWE-bench_ProScore | 59.6 | Quelle ↗Community · abgerufen 2026-10-10 |
| SWE-bench/SWE-bench_VerifiedScore | 79 | Quelle ↗Community · abgerufen 2026-10-10 |
| cais/hleScore | 33.4 | Quelle ↗Community · abgerufen 2026-10-10TestdetailsWith tools. |
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
| Benchmark | Wert | Beleg |
|---|---|---|
| harborframework/terminal-bench-2.1Score | 47 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsClaude Code 2.1.126 harness, parser=json, temperature=1.0, top_p=1.0, max_new_tokens=131072, avg of 5 runs. |
| harborframework/terminal-bench-2.1Score | 46.2 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsTerminus-2 harness (Harbor framework), parser=json, temperature=1.0, top_p=1.0, 128K context, 4h timeout, avg of 5 runs. |
| SWE-bench/SWE-bench_MultilingualScore | 54.4 | Quelle ↗Community · abgerufen 2026-10-10 |
| ScaleAI/SWE-bench_ProScore | 47.5 | Quelle ↗Community · abgerufen 2026-10-10 |
| SWE-bench/SWE-bench_VerifiedScore | 70.6 | Quelle ↗Community · abgerufen 2026-10-10 |
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
| Benchmark | Wert | Beleg |
|---|---|---|
| harborframework/terminal-bench-2.1Score | 62.8 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsClaude Code 2.1.126 harness, parser=json, temperature=1.0, top_p=1.0, max_new_tokens=131072, avg of 5 runs. |
| harborframework/terminal-bench-2.1Score | 64.2 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsTerminus-2 harness (Harbor framework), parser=json, temperature=1.0, top_p=1.0, 128K context, 4h timeout, avg of 5 runs. |
| SWE-bench/SWE-bench_MultilingualScore | 69.3 | Quelle ↗Community · abgerufen 2026-10-10 |
| ScaleAI/SWE-bench_ProScore | 50.4 | Quelle ↗Community · abgerufen 2026-10-10 |
| SWE-bench/SWE-bench_VerifiedScore | 75.6 | Quelle ↗Community · abgerufen 2026-10-10 |
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
| Benchmark | Wert | Beleg |
|---|---|---|
| harborframework/terminal-bench-2.1Score | 40.6 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsClaude Code 2.1.126 harness, parser=json, temperature=1.0, top_p=1.0, max_new_tokens=131072, avg of 5 runs. |
| harborframework/terminal-bench-2.1Score | 43.1 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsTerminus-2 harness (Harbor framework), parser=json, temperature=1.0, top_p=1.0, 128K context, 4h timeout, avg of 5 runs. |
| SWE-bench/SWE-bench_MultilingualScore | 52 | Quelle ↗Community · abgerufen 2026-10-10 |
| ScaleAI/SWE-bench_ProScore | 42.9 | Quelle ↗Community · abgerufen 2026-10-10 |
| SWE-bench/SWE-bench_VerifiedScore | 69.4 | Quelle ↗Community · abgerufen 2026-10-10 |
Technische Leistungsdaten sind für diese Variante noch nicht vollständig bestätigt.
| Benchmark | Wert | Beleg |
|---|---|---|
| harborframework/terminal-bench-2.1Score | 77.5 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsTerminus-2 harness (Harbor framework), parser=json, temperature=1.0, top_p=1.0, 128K context, 4h timeout, avg of 5 runs. |
| harborframework/terminal-bench-2.1Score | 78.2 | Quelle ↗Community · abgerufen 2026-10-11TestdetailsClaude Code 2.1.126 harness, parser=json, temperature=1.0, top_p=1.0, max_new_tokens=131072, avg of 5 runs. |
| SWE-bench/SWE-bench_MultilingualScore | 78.9 | Quelle ↗Community · abgerufen 2026-10-10 |
| ScaleAI/SWE-bench_ProScore | 62.2 | Quelle ↗Community · abgerufen 2026-10-10 |
| SWE-bench/SWE-bench_VerifiedScore | 82.4 | Quelle ↗Community · abgerufen 2026-10-10 |
Alle verbundenen Artikel, neueste zuerst.
Noch keine verbundenen Artikel.