Modeller
Ændringer siden forrige snapshot
Vægtene er landet
- K2 Horizon 375B A23B: vægtene er landet — modellen ligger nu på Hugging Face som IFM/K2-Horizon-375B-A23B.
Ny i indekset
- Exaone 4.0 1.2B (Non-reasoning) er ny i Artificial Analysis' indeks (intelligence 1, LG AI Research).
- Mistral Small (Feb '24) er ny i Artificial Analysis' indeks (intelligence 1, Mistral).
- Qwen3 1.7B (Non-reasoning) er ny i Artificial Analysis' indeks (intelligence 1, Alibaba).
- Qwen3.5 0.8B (Non-reasoning) er ny i Artificial Analysis' indeks (intelligence 1, Alibaba).
Score ændret
- Gemini 3.8 Flash (high): intelligence 58.7 → 47.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-5.3-Flash: intelligence 57.5 → 46.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 3.6 Flash (high): intelligence 51.6 → 40.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.8 Max: intelligence 58.1 → 46.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V4 Pro 0813 (Reasoning, Max Effort): intelligence 53.2 → 42.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.8 2.4T A95B: intelligence 57.7 → 46.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V4 Flash 0731 (Reasoning, Max Effort): intelligence 51.8 → 40.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-5.3 (max): intelligence 59.5 → 48.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Opus 4.8 (Adaptive Reasoning, Max Effort): intelligence 57.3 → 46.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 3.7 Flash (high): intelligence 56 → 45.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.5 (xhigh): intelligence 56.3 → 45.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Opus 4.7 (Adaptive Reasoning, Max Effort): intelligence 55 → 44.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Muse Glimmer (high): intelligence 35.1 → 24.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.8 27B (xhigh): intelligence 52 → 41.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ling 3.0 Flash: intelligence 37.8 → 27.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 4.6 (high): intelligence 60.9 → 50.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 4.5 (high): intelligence 55.8 → 45.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.4 (xhigh): intelligence 53.1 → 42.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiMo-V2.5-Pro: intelligence 42.9 → 32.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.8-Flash-Next: intelligence 55.8 → 45.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Sonnet 5 (Adaptive Reasoning, Max Effort): intelligence 55.3 → 45.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-5.2 (max): intelligence 52.6 → 42.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 3.5 Flash (high): intelligence 52 → 41.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Inkling (xhigh): intelligence 42.3 → 32.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Muse Spark 1.2 (xhigh): intelligence 56.8 → 46.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V4 Flash Vision (Reasoning, Max Effort): intelligence 51.5 → 41.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Muse Spark 1.1 (xhigh): intelligence 53.2 → 43.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort): intelligence 48.4 → 38.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.6 Terra (max): intelligence 56.6 → 46.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 3.5 Flash-Lite: intelligence 37.4 → 27.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.7 Max: intelligence 46.7 → 37, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniMax-M3: intelligence 45.4 → 35.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.6 Sol (max): intelligence 60.9 → 51.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Agnes 2.5 Pro Beta: intelligence 49.1 → 39.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Kimi K3 (max): intelligence 59.7 → 50.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- K2 Horizon 375B A23B: intelligence 47.3 → 37.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V4 Pro (Reasoning, Max Effort): intelligence 45.3 → 35.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Muse Spark 1.3 (max): intelligence 62.1 → 52.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 3.1 Pro Preview: intelligence 47.7 → 38.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Motif 3: intelligence 47.4 → 38, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Kimi K2.6: intelligence 45.1 → 35.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Apodex 1.1: intelligence 44 → 34.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Kimi K2.7 Code: intelligence 43 → 33.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Quasar 438B (max, based on GLM-5.2): intelligence 43 → 33.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-5.1 (Reasoning): intelligence 41 → 31.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Opus 5 (Adaptive Reasoning, Max Effort): intelligence 63.1 → 54.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Hy3: intelligence 42.2 → 33.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V4 Flash (Reasoning, Max Effort): intelligence 42.1 → 33.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nex-N2-Pro: intelligence 41.7 → 32.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.4 mini (xhigh): intelligence 40.9 → 31.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok Build 0.1 0616: intelligence 40.7 → 31.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.6 Plus: intelligence 40.5 → 31.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback): intelligence 65.7 → 56.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback): intelligence 62.1 → 53.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.6 Luna (max): intelligence 52.3 → 43.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Solar Pro 4: intelligence 41.6 → 32.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Inkling Small: intelligence 41.2 → 32.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.4 nano (xhigh): intelligence 39.7 → 30.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniMax-M2.7: intelligence 38.9 → 30.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ling 3.0 Tiny: intelligence 24.5 → 15.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nemotron 3 Ultra 550B A55B (Reasoning): intelligence 38.3 → 29.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.6 27B (Reasoning): intelligence 37.7 → 29, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.3 Codex (xhigh): intelligence 45.5 → 36.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.7 Plus: intelligence 39.4 → 30.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 4.3 (high): intelligence 37.9 → 29.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Opus 4.6 (Adaptive Reasoning, Max Effort): intelligence 44.9 → 36.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Muse Spark: intelligence 44.3 → 35.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Agnes 2.5 Pro Alpha: intelligence 39.7 → 31.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiMo-V2.5: intelligence 38 → 29.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- gpt-oss-120b (high): intelligence 24.1 → 15.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.1 (high): intelligence 37.5 → 29.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 4.5 Sonnet (Reasoning): intelligence 37.4 → 29, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Solar Open2 250B: intelligence 37.4 → 29, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Kimi K2.5 (Reasoning): intelligence 36 → 27.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.2 (xhigh): intelligence 43.3 → 35, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Opus 4.5 (Reasoning): intelligence 41.9 → 33.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiMo-V2-Pro: intelligence 41.4 → 33.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-4.7 (Reasoning): intelligence 34.5 → 26.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- G9v3-39A5B: intelligence 34 → 25.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.2 Codex (xhigh): intelligence 41.2 → 33, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.6 Max Preview: intelligence 41.1 → 32.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 3 Pro Preview (high): intelligence 40.6 → 32.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-5 (Reasoning): intelligence 40.6 → 32.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5 (high): intelligence 35.3 → 27.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- A.X-K2: intelligence 35 → 26.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 397B A17B (Reasoning): intelligence 34.3 → 26.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LongCat 2.0: intelligence 34 → 25.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- JT-4.1 Flash 236B A21B: intelligence 39.9 → 31.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-5-Turbo: intelligence 39.1 → 31, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- KAT Coder Pro V2: intelligence 33.7 → 25.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 3 Flash Preview (Reasoning): intelligence 38.7 → 30.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 4.20 0309 v2 (Reasoning): intelligence 38 → 30, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 122B A10B (Reasoning): intelligence 32.8 → 24.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ring-2.6-1T: intelligence 31.7 → 23.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Step 3.7 Flash: intelligence 30.9 → 22.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 4.20 0309 (Reasoning): intelligence 37.4 → 29.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiMo-V2-Omni-0327: intelligence 37.3 → 29.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V3.1 Terminus (Reasoning): intelligence 31.4 → 23.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- K-EXAONE 2.0: intelligence 31 → 23.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5 Codex (high): intelligence 37 → 29.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiMo-V2-Omni: intelligence 35.9 → 28.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.1 Codex (high): intelligence 35.6 → 27.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM 5V Turbo (Reasoning): intelligence 35.3 → 27.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 27B (Reasoning): intelligence 34.6 → 26.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniMax-M2.5: intelligence 34.5 → 26.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Medium 3.5: intelligence 30.4 → 22.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 4.1 Opus (Reasoning): intelligence 34.5 → 26.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Hy3-preview (Reasoning): intelligence 34.4 → 26.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.5 Instant (May 2026): intelligence 34.3 → 26.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 4: intelligence 34.1 → 26.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiMo-V2-Flash (Feb 2026): intelligence 34 → 26.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Kimi K2 Thinking: intelligence 33.5 → 25.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- o3-pro: intelligence 33.3 → 25.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 4 Sonnet (Reasoning): intelligence 29.8 → 22.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-4.6 (Reasoning): intelligence 29.3 → 21.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V3.2 (Reasoning): intelligence 32.8 → 25.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Max Thinking: intelligence 32.5 → 25, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniMax-M2.1: intelligence 32.1 → 24.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 4 31B (Reasoning): intelligence 29.7 → 22.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 4 Opus (Reasoning): intelligence 31.7 → 24.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5 mini (medium): intelligence 31.6 → 24.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 4.1 Fast (Reasoning): intelligence 31.3 → 23.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- o3: intelligence 31.1 → 23.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 4.5 Haiku (Reasoning): intelligence 29.9 → 22.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5.1 Codex mini (high): intelligence 31.3 → 24, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 Omni Plus: intelligence 31.3 → 24, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 35B A3B (Reasoning): intelligence 29.9 → 22.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- JT-35B-Flash: intelligence 29 → 21.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- KAT-Coder-Pro V1: intelligence 28.9 → 21.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniMax-M2: intelligence 28.9 → 21.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.2 30B: intelligence 23.7 → 16.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nemotron 3.5 Lightning: intelligence 23.6 → 16.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Command A+: intelligence 22.8 → 15.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 4 Fast (Reasoning): intelligence 27.9 → 20.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 3.7 Sonnet (Reasoning): intelligence 27.6 → 20.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nemotron 3 Super 120B A12B (Reasoning): intelligence 25.7 → 18.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ling-2.6-1T: intelligence 26.6 → 19.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Doubao Seed Code: intelligence 26.5 → 19.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Step 3.5 Flash 2603: intelligence 26.5 → 19.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- o4-mini (high): intelligence 26.1 → 19.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mercury 2: intelligence 21.9 → 14.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 9B (Reasoning): intelligence 21.8 → 14.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Coder Next: intelligence 21.3 → 14.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 4 26B A4B (Reasoning): intelligence 26.1 → 19.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Step 3.5 Flash: intelligence 26 → 19.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V3.2 Exp (Reasoning): intelligence 25.9 → 19, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.5 Pro: intelligence 25.9 → 19, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 3.1 Flash-Lite: intelligence 25.6 → 18.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Max: intelligence 24.5 → 17.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Small 4 (Reasoning): intelligence 19.7 → 12.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.5 Flash Preview (Sep '25) (Reasoning): intelligence 24.2 → 17.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Kimi K2 0905: intelligence 24 → 17.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- o1: intelligence 23.9 → 17.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 235B A22B 2507 (Reasoning): intelligence 19.9 → 13.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.5 Pro Preview (Mar' 25): intelligence 23.4 → 16.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-4.7-Flash (Reasoning): intelligence 23.3 → 16.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 3 mini Reasoning (high): intelligence 22.9 → 16.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- K-EXAONE (Reasoning): intelligence 22.5 → 15.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- North Mini Code: intelligence 20.2 → 13.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Trinity Large Thinking: intelligence 18.7 → 12, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V3.2 Speciale: intelligence 22.6 → 16, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- ERNIE 5.0 Thinking Preview: intelligence 22.3 → 15.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 4 12B (Reasoning): intelligence 22.2 → 15.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nova 2.0 Pro Preview (medium): intelligence 22.1 → 15.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok Code Fast 1: intelligence 22 → 15.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Apriel-v1.5-15B-Thinker: intelligence 21.6 → 15, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V3.1 (Non-reasoning): intelligence 21.4 → 14.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nova 2.0 Omni (medium): intelligence 21.3 → 14.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek R1 (Jan '25): intelligence 18.6 → 12, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- HyperNova 60B 2605 (high, based on gpt-oss-120b): intelligence 18.3 → 11.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-6 Astra (max): intelligence 61.2 → 54.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 235B A22B (Reasoning): intelligence 20.9 → 14.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Apriel-v1.6-15B-Thinker: intelligence 20.8 → 14.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nova 2.0 Lite (high): intelligence 20.8 → 14.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- EXAONE 4.5 33B: intelligence 20.5 → 14, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek R1 0528 (May '25): intelligence 20.4 → 13.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 4B (Reasoning): intelligence 20.4 → 13.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Devstral 2: intelligence 19.2 → 12.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Devstral Small 2: intelligence 17.7 → 11.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.5 Flash (Reasoning): intelligence 20.3 → 13.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-5 nano (high): intelligence 20.1 → 13.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-4.5 (Reasoning): intelligence 19.7 → 13.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Kimi K2: intelligence 19.7 → 13.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-4.1: intelligence 19.6 → 13.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- JT-MINI: intelligence 18.8 → 12.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- o3-mini: intelligence 19.2 → 12.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 Omni Flash: intelligence 19.2 → 12.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- o1-pro: intelligence 19.1 → 12.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 3: intelligence 18.6 → 12.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Seed-OSS-36B-Instruct: intelligence 18.5 → 12.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 235B A22B 2507 Instruct: intelligence 18.4 → 12.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Coder 480B A35B Instruct: intelligence 18.2 → 11.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniMax M1 80k: intelligence 17.9 → 11.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nemotron Cascade 2 30B A3B: intelligence 17.8 → 11.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Small 3.1: intelligence 14.9 → 8.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Medium 3.1: intelligence 14.7 → 8.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ling 2.6 Flash: intelligence 14.2 → 7.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 32B (Reasoning): intelligence 18.1 → 11.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Magistral Medium 1.2: intelligence 18 → 11.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Sonar Reasoning Pro: intelligence 18 → 11.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- K2 Think V2: intelligence 17.4 → 11.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LongCat Flash Lite: intelligence 17.4 → 11.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- HyperCLOVA X SEED Think (32B): intelligence 17.2 → 11, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- o1-preview: intelligence 17.2 → 11, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-4.6V (Reasoning): intelligence 16.9 → 10.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Next 80B A3B (Reasoning): intelligence 16.9 → 10.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-4.5-Air: intelligence 16.7 → 10.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mi:dm K 2.5 Pro: intelligence 16.6 → 10.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Large 3: intelligence 15.9 → 9.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ring-1T: intelligence 16.3 → 10.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- G9v3-3B: intelligence 16.2 → 10.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- INTELLECT-3: intelligence 15.7 → 9.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- gpt-oss-20b (high): intelligence 15.2 → 9.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Celeris-1: intelligence 12.4 → 6.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V3 0324: intelligence 15.2 → 9.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning): intelligence 15.2 → 9.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 3 Reasoning Beta: intelligence 15.2 → 9.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Solar Open 100B (Reasoning): intelligence 15.2 → 9.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nemotron 3 Nano Omni 30B A3B Reasoning: intelligence 15 → 9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-4.1 mini: intelligence 14.8 → 8.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 30B A3B 2507 (Reasoning): intelligence 14.6 → 8.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 4 Maverick: intelligence 14.5 → 8.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniMax M1 40k: intelligence 14.5 → 8.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Solar Pro 3: intelligence 14.5 → 8.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 235B A22B Instruct: intelligence 14.4 → 8.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Next 80B A3B Instruct: intelligence 13.8 → 7.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.6 35B A3B (Reasoning): intelligence 32.1 → 26.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- NVIDIA Nemotron 3 Nano 30B A3B (Reasoning): intelligence 14.5 → 8.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek V3 (Dec '24): intelligence 14.2 → 8.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- K2-V2 (high): intelligence 14.2 → 8.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- o1-mini: intelligence 14 → 8.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-4.5 (Preview): intelligence 13.6 → 7.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Coder 30B A3B Instruct: intelligence 13.6 → 7.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Tri-21B-think Preview: intelligence 13.6 → 7.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DiffusionGemma 26B A4B: intelligence 13.5 → 7.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 235B A22B (Reasoning): intelligence 13.5 → 7.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 30B A3B (Reasoning): intelligence 13.4 → 7.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- QwQ 32B: intelligence 13.4 → 7.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.0 Flash Thinking Experimental (Jan '25): intelligence 13.3 → 7.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Motif-2-12.7B-Reasoning: intelligence 12.8 → 7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ling-1T: intelligence 12.7 → 6.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nova Premier: intelligence 12.7 → 6.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Magistral Medium 1: intelligence 12.5 → 6.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Medium 3: intelligence 12.5 → 6.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Solar Pro 2 (Preview) (Reasoning): intelligence 12.5 → 6.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Devstral Medium: intelligence 12.4 → 6.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama Nemotron Super 49B v1.5 (Reasoning): intelligence 12.4 → 6.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-4o (March 2025, chatgpt-4o-latest): intelligence 12.3 → 6.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 4 E4B (Reasoning): intelligence 12.2 → 6.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.3 Nemotron Super 49B v1 (Reasoning): intelligence 12.2 → 6.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 3 Opus: intelligence 11.8 → 6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Devstral Small (May '25): intelligence 11.8 → 6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Magistral Small 1.2: intelligence 11.5 → 5.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.5 Flash-Lite (Reasoning): intelligence 11.4 → 5.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.2 8B: intelligence 19.6 → 13.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Tri-21B-Think: intelligence 12.3 → 6.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 3.5 Haiku: intelligence 12.2 → 6.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.0 Flash (Feb '25): intelligence 12.2 → 6.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniCPM5-1B (Reasoning): intelligence 11.9 → 6.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 4B 2507 (Reasoning): intelligence 11.9 → 6.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Sarvam 105B (high): intelligence 11.9 → 6.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.0 Pro Experimental (Feb '25): intelligence 11.8 → 6.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Sonar Reasoning: intelligence 11.6 → 5.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 32B (Reasoning): intelligence 11.4 → 5.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ministral 3 14B: intelligence 11.2 → 5.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek R1 Distill Qwen 32B: intelligence 11 → 5.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LFM2.5-2.6B: intelligence 11 → 5.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nanbeige4.1-3B: intelligence 11 → 5.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 32B Instruct: intelligence 11 → 5.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Small 3.2: intelligence 10.7 → 5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 4 Scout: intelligence 10.3 → 4.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Magistral Small 1: intelligence 10.6 → 5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- EXAONE 4.0 32B (Reasoning): intelligence 10.5 → 4.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 8B (Reasoning): intelligence 10.5 → 4.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 14B (Reasoning): intelligence 10.4 → 4.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek R1 0528 Qwen3 8B: intelligence 10.3 → 4.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen2.5 Max: intelligence 10.1 → 4.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 1.5 Pro (Sep '24): intelligence 9.9 → 4.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Hermes 4 - Llama-3.1 70B (Reasoning): intelligence 9.9 → 4.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 30B A3B Instruct: intelligence 9.9 → 4.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 3.5 Sonnet (Oct '24): intelligence 9.8 → 4.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek R1 Distill Llama 70B: intelligence 9.8 → 4.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek R1 Distill Qwen 14B: intelligence 9.7 → 4.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Falcon-H1R-7B: intelligence 9.7 → 4.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Sonar: intelligence 9.4 → 3.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.3 Instruct 70B: intelligence 9.3 → 3.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 30B A3B (Reasoning): intelligence 9.2 → 3.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-4.1 nano: intelligence 9.6 → 4.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ling-flash-2.0: intelligence 9.6 → 4.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 4 E2B (Reasoning): intelligence 9.5 → 4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Omni 30B A3B (Reasoning): intelligence 9.5 → 4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen2.5 Instruct 72B: intelligence 9.4 → 3.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Step3 VL 10B: intelligence 9.3 → 3.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- QwQ 32B-Preview: intelligence 9.1 → 3.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Sonar Pro: intelligence 9.1 → 3.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GLM-4.5V (Reasoning): intelligence 9 → 3.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ministral 3 8B: intelligence 9 → 3.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Large 2 (Nov '24): intelligence 9 → 3.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- ERNIE 4.5 300B A47B: intelligence 8.9 → 3.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.1 Nemotron Ultra 253B v1 (Reasoning): intelligence 8.9 → 3.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 30B A3B 2507 Instruct: intelligence 8.9 → 3.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- NVIDIA Nemotron Nano 12B v2 VL (Reasoning): intelligence 8.8 → 3.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.1 30B: intelligence 8.7 → 3.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- NVIDIA Nemotron Nano 9B V2 (Reasoning): intelligence 8.7 → 3.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- NVIDIA Nemotron 3 Nano 4B: intelligence 8.6 → 3.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Kimi Linear 48B A3B Instruct: intelligence 8.4 → 2.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning): intelligence 8.4 → 2.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 8B (Reasoning): intelligence 8.3 → 2.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 4B (Reasoning): intelligence 8.2 → 2.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Pixtral Large: intelligence 8 → 2.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Hermes 4 - Llama-3.1 405B (Reasoning): intelligence 8.8 → 3.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 2.0 Flash-Lite (Feb '25): intelligence 8.6 → 3.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.1 Instruct 405B: intelligence 8.3 → 2.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 8B Instruct: intelligence 8.2 → 2.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LFM2.5-8B-A1B: intelligence 8.1 → 2.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.1 Tulu3 405B: intelligence 8.1 → 2.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ring-flash-2.0: intelligence 8 → 2.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Olmo 3.1 32B Think: intelligence 7.9 → 2.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 1.5 Flash (Sep '24): intelligence 7.8 → 2.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok 2 (Dec '24): intelligence 7.8 → 2.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-4 Turbo: intelligence 7.7 → 2.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 4B (Reasoning): intelligence 7.7 → 2.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nova Pro: intelligence 7.5 → 2.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 3 27B Instruct: intelligence 7.4 → 2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.1 Instruct 8B: intelligence 7.4 → 2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok Beta: intelligence 7.3 → 1.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ministral 3 3B: intelligence 7.1 → 1.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.1 Nemotron Instruct 70B: intelligence 7.4 → 2.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3.5 2B (Reasoning): intelligence 7.4 → 2.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen2.5 Instruct 32B: intelligence 7.2 → 1.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen2.5 Coder Instruct 32B: intelligence 6.9 → 1.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 4B 2507 Instruct: intelligence 6.9 → 1.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-4: intelligence 6.8 → 1.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-4o mini: intelligence 6.7 → 1.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Small 3: intelligence 6.7 → 1.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nova Lite: intelligence 6.7 → 1.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek-V2.5 (Dec '24): intelligence 6.5 → 1.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.1 Instruct 70B: intelligence 6.5 → 1.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.1 8B: intelligence 6.4 → 1.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Sarvam 30B (high): intelligence 6.4 → 1.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek R1 Distill Llama 8B: intelligence 6.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Saba: intelligence 6.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Olmo 3.1 32B Instruct: intelligence 6.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Olmo 3 32B Think: intelligence 6.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.2 Instruct 90B (Vision): intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen2.5 Turbo: intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- R1 1776: intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Reka Flash (Sep '24): intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Solar Mini: intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Grok-1: intelligence 5.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Phi-4 Mini Instruct: intelligence 5.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen2 Instruct 72B: intelligence 5.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 3 12B Instruct: intelligence 5.5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 1.5 Flash-8B: intelligence 5.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepHermes 3 - Mistral 24B Preview (Non-reasoning): intelligence 5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Jamba 1.7 Large: intelligence 5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.0 H Small: intelligence 4.9 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Hermes 3 - Llama-3.1 70B: intelligence 4.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Jamba 1.5 Large: intelligence 4.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 Omni 30B A3B Instruct: intelligence 4.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek-Coder-V2: intelligence 4.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Jamba 1.6 Large: intelligence 4.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- OLMo 2 32B: intelligence 4.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.2 3B: intelligence 14.3 → 10.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LFM2 24B A2B: intelligence 4.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Phi-4: intelligence 4.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 3 Sonnet: intelligence 4.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.1 3B: intelligence 4.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Nova Micro: intelligence 4.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 1.0 Ultra: intelligence 4.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Phi-3 Mini Instruct 3.8B: intelligence 4.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 3n E4B Instruct Preview (May '25): intelligence 4.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Phi-4 Multimodal Instruct: intelligence 4.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Large (Feb '24): intelligence 4.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen2.5 Coder Instruct 7B : intelligence 4.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mixtral 8x22B Instruct: intelligence 4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 2 Chat 7B: intelligence 3.9 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.2 Instruct 3B: intelligence 3.9 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Jamba Reasoning 3B: intelligence 3.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- MiniCPM-V 4.6 1.3B: intelligence 3.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen1.5 Chat 110B: intelligence 3.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen3 VL 4B Instruct: intelligence 3.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Reka Flash 3: intelligence 3.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Olmo 3 7B Think: intelligence 3.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 2.1: intelligence 3.5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 3 Haiku: intelligence 3.5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- OLMo 2 7B: intelligence 3.5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Ling-mini-2.0: intelligence 3.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Molmo 7B-D: intelligence 3.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude 2.0: intelligence 3.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek R1 Distill Qwen 1.5B: intelligence 3.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek-V2-Chat: intelligence 3.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- GPT-3.5 Turbo: intelligence 3.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral Medium: intelligence 3.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3 Instruct 70B: intelligence 3.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Arctic Instruct: intelligence 3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LFM 40B: intelligence 3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 3.2 Instruct 11B (Vision): intelligence 3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen Chat 72B: intelligence 3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- PALM-2: intelligence 2.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek Coder V2 Lite Instruct: intelligence 2.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemini 1.0 Pro: intelligence 2.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Command-R+ (Apr '24): intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DBRX Instruct: intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepSeek LLM 67B Chat (V1): intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 2 Chat 13B: intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 2 Chat 70B: intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- OpenChat 3.5 (1210): intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Sarvam M (Reasoning): intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Olmo 3 7B Instruct: intelligence 2.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Jamba 1.5 Mini: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Jamba 1.7 Mini: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LFM2 2.6B: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LFM2.5-1.2B-Instruct: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- LFM2.5-1.2B-Thinking: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.0 H 1B: intelligence 2.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Jamba 1.6 Mini: intelligence 2.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Apertus 70B Instruct: intelligence 2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Gemma 3 270M: intelligence 2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.0 Micro: intelligence 2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mixtral 8x7B Instruct: intelligence 2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning): intelligence 1.9 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Claude Instant: intelligence 1.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Llama 65B: intelligence 1.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Mistral 7B Instruct: intelligence 1.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Qwen Chat 14B: intelligence 1.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Granite 4.0 1B: intelligence 1.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
- Molmo2-8B: intelligence 1.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
Ny i HF-trending
- fanuonai/ice-012-audio er ny i Hugging Faces trending (score 56).
- IFM/K2-Horizon-375B-A23B er ny i Hugging Faces trending (score 48).
- facebook/sam3.1 er ny i Hugging Faces trending (score 41).
- black-forest-labs/FLUX.2-klein-base-9b-fp8 er ny i Hugging Faces trending (score 38, 1 derivater).
- ByteDance/Ouro-1.4B er ny i Hugging Faces trending (score 37).
Intelligence Index — Artificial Analysis
| # | Model | Intel. | Agentic | Creator | Udgivet |
|---|---|---|---|---|---|
| 1 | Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 5 effort-varianter | 56.8 | 58.2 | Anthropic | 2026-09-01 |
| 2 | GPT-6 Astra (max) 6 effort-varianter | 54.7 | 51.6 | OpenAI | 2026-09-03 |
| 3 | Claude Opus 5 (Adaptive Reasoning, Max Effort) 5 effort-varianter | 54.1 | 56.4 | Anthropic | 2026-07-24 |
| 4 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) | 53.2 | 51.2 | Anthropic | 2026-06-09 |
| 5 | Muse Spark 1.3 (max) 2 effort-varianter | 52.7 | 55.6 | Meta | 2026-09-02 |
| 6 | GPT-5.6 Sol (max) 6 effort-varianter | 51.3 | 50.7 | OpenAI | 2026-07-09 |
| 7 | Grok 4.6 (high) 4 effort-varianter | 50.6 | 53.6 | SpaceXAI | 2026-08-12 |
| 8 | Kimi K3 (max) 2 effort-varianter ⬇ hf.co/moonshotai/Kimi-K3 | 50.2 | 50.9 | Kimi | 2026-07-16 |
| 9 | GLM-5.3 (max) ⬇ hf.co/zai-org/GLM-5.3 | 48.6 | 53.6 | Z AI | 2026-08-18 |
| 10 | Gemini 3.8 Flash (high) 3 effort-varianter | 47.1 | 41.2 | 2026-09-02 | |
| 11 | Qwen3.8 Max | 46.9 | 49.9 | Alibaba | 2026-08-03 |
| 12 | GPT-5.6 Terra (max) 6 effort-varianter | 46.8 | 43.9 | OpenAI | 2026-07-09 |
| 13 | Muse Spark 1.2 (xhigh) | 46.8 | 44.2 | Meta | 2026-08-05 |
| 14 | Qwen3.8 2.4T A95B ⬇ hf.co/Qwen/Qwen3.8-2.4T-A95B | 46.7 | 50.7 | Alibaba | 2026-08-12 |
| 15 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort) | 46.4 | 42.8 | Anthropic | 2026-05-28 |
| 16 | GLM-5.3-Flash ⬇ hf.co/zai-org/GLM-5.3-Flash | 46.2 | 51.5 | Z AI | 2026-08-26 |
| 17 | GPT-5.5 (xhigh) 5 effort-varianter | 45.6 | 37.5 | OpenAI | 2026-04-23 |
| 18 | Qwen3.8-Flash-Next ⬇ hf.co/Qwen/Qwen3.8-Flash-Next | 45.6 | Alibaba | 2026-08-26 | |
| 19 | Grok 4.5 (high) | 45.5 | 42.4 | SpaceXAI | 2026-07-08 |
| 20 | Gemini 3.7 Flash (high) 3 effort-varianter | 45.2 | 36.6 | 2026-08-13 | |
| 21 | Claude Sonnet 5 (Adaptive Reasoning, Max Effort) 6 effort-varianter | 45.1 | 44.5 | Anthropic | 2026-06-30 |
| 22 | Claude Opus 4.7 (Adaptive Reasoning, Max Effort) 2 effort-varianter | 44.3 | 39.7 | Anthropic | 2026-04-16 |
| 23 | GPT-5.6 Luna (max) 6 effort-varianter | 43.4 | 42.9 | OpenAI | 2026-07-09 |
| 24 | Muse Spark 1.1 (xhigh) | 43.3 | 27.8 | Meta | 2026-07-09 |
| 25 | GPT-5.4 (xhigh) 3 effort-varianter | 42.8 | OpenAI | 2026-03-05 | |
| 26 | GLM-5.2 (max) 2 effort-varianter ⬇ hf.co/zai-org/GLM-5.2 | 42.5 | 39.7 | Z AI | 2026-06-16 |
| 27 | DeepSeek V4 Pro 0813 (Reasoning, Max Effort) ⬇ hf.co/deepseek-ai/DeepSeek-V4-Pro | 42.1 | 42.5 | DeepSeek | 2026-08-13 |
| 28 | Gemini 3.5 Flash (high) 3 effort-varianter | 41.9 | 27.4 | 2026-05-19 | |
| 29 | Qwen3.8 27B (xhigh) 4 effort-varianter ⬇ hf.co/Qwen/Qwen3.8-27B | 41.6 | 46.8 | Alibaba | 2026-08-14 |
| 30 | DeepSeek V4 Flash Vision (Reasoning, Max Effort) | 41.5 | DeepSeek | 2026-08-21 | |
| 31 | DeepSeek V4 Flash 0731 (Reasoning, Max Effort) ⬇ hf.co/deepseek-ai/DeepSeek-V4-Flash-0731 | 40.8 | 41.9 | DeepSeek | 2026-07-31 |
| 32 | Gemini 3.6 Flash (high) | 40.3 | 30.3 | 2026-07-21 | |
| 33 | Agnes 2.5 Pro Beta | 39.5 | Sapiens AI | 2026-08-26 | |
| 34 | Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) 3 effort-varianter | 38.5 | 33.3 | Anthropic | 2026-02-17 |
| 35 | Gemini 3.1 Pro Preview | 38.3 | 10.4 | 2026-02-19 | |
| 36 | Motif 3 2 effort-varianter ⬇ hf.co/Motif-Technologies/Motif-3 | 38 | Motif Technologies | 2026-08-12 | |
| 37 | K2 Horizon 375B A23B ⬇ hf.co/IFM/K2-Horizon-375B-A23B | 37.8 | 41.2 | MBZUAI Institute of Foundation Models | 2026-09-03 |
| 38 | Qwen3.7 Max | 37 | 23.9 | Alibaba | 2026-05-19 |
| 39 | GPT-5.3 Codex (xhigh) | 36.9 | OpenAI | 2026-02-05 | |
| 40 | Claude Opus 4.6 (Adaptive Reasoning, Max Effort) 2 effort-varianter | 36.4 | Anthropic | 2026-02-05 |
Hugging Face — trending familier
| # | Rod-repo | Trending | Likes | Downloads | Params | Alder |
|---|---|---|---|---|---|---|
| 1 | deepseek-ai/DeepSeek-V4-Flash-Vision-Exp +1 derivater | 564 | 608 | 133024 | 304.6B | 5 d |
| 2 | Qwen/Qwen3.8-27B +17 derivater | 549 | 13963 | 5739341 | 27.8B | 31 d |
| 3 | Qwen/Qwen3.8-Flash-Next +5 derivater | 534 | 4880 | 351374 | 180.0B | 12 d |
| 4 | zai-org/GLM-5.3 | 455 | 1705 | 303534 | 753.3B | 11 d |
| 5 | zai-org/GLM-5.3-Flash +3 derivater | 445 | 2053 | 654957 | 321.3B | 11 d |
| 6 | XHToken/Spark-X2.5-4B-Base +2 derivater | 392 | 478 | 3524 | 4.1B | 12 d |
| 7 | google/timesfm-3.0-pytorch | 388 | 432 | 105304 | 330.7M | 11 d |
| 8 | Lightricks/LTX-2.5 | 376 | 2793 | 1399511 | 44 d | |
| 9 | BreezeBlue/Breeze-TTS-2 | 260 | 434 | 5388 | 3.5B | 10 d |
| 10 | MiniMaxAI/MiniMax-H3 +9 derivater | 245 | 4911 | 5118457 | 33.1B | 39 d |
| 11 | nreimers/MiniLM-L6-H384-uncased +1 derivater | 226 | 5519 | 253789790 | 22.7M | 1647 d |
| 12 | openai-community/gpt2 | 222 | 3661 | 14607268 | 137.0M | 1647 d |
| 13 | google-bert/bert-base-uncased | 197 | 2951 | 58675189 | 110.1M | 1647 d |
| 14 | facebook/mms-300m | 194 | 237 | 12823 | 1201 d | |
| 15 | FastVideo/FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree | 192 | 277 | 0 | 35.0B | 9 d |
Params er safetensors.total, altså lagrede vægte inklusive
kvantiserede tensorer — ikke et mål for hvad modellen kræver af hardware.