News-Tracker

Modeller

AI & LLM · daglig briefing


Ændringer siden forrige snapshot

Vægtene er landet

  • K2 Horizon 375B A23B: vægtene er landet — modellen ligger nu på Hugging Face som IFM/K2-Horizon-375B-A23B.

Ny i indekset

  • Exaone 4.0 1.2B (Non-reasoning) er ny i Artificial Analysis' indeks (intelligence 1, LG AI Research).
  • Mistral Small (Feb '24) er ny i Artificial Analysis' indeks (intelligence 1, Mistral).
  • Qwen3 1.7B (Non-reasoning) er ny i Artificial Analysis' indeks (intelligence 1, Alibaba).
  • Qwen3.5 0.8B (Non-reasoning) er ny i Artificial Analysis' indeks (intelligence 1, Alibaba).

Score ændret

  • Gemini 3.8 Flash (high): intelligence 58.7 → 47.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-5.3-Flash: intelligence 57.5 → 46.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 3.6 Flash (high): intelligence 51.6 → 40.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.8 Max: intelligence 58.1 → 46.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V4 Pro 0813 (Reasoning, Max Effort): intelligence 53.2 → 42.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.8 2.4T A95B: intelligence 57.7 → 46.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V4 Flash 0731 (Reasoning, Max Effort): intelligence 51.8 → 40.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-5.3 (max): intelligence 59.5 → 48.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Opus 4.8 (Adaptive Reasoning, Max Effort): intelligence 57.3 → 46.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 3.7 Flash (high): intelligence 56 → 45.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.5 (xhigh): intelligence 56.3 → 45.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Opus 4.7 (Adaptive Reasoning, Max Effort): intelligence 55 → 44.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Muse Glimmer (high): intelligence 35.1 → 24.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.8 27B (xhigh): intelligence 52 → 41.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ling 3.0 Flash: intelligence 37.8 → 27.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 4.6 (high): intelligence 60.9 → 50.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 4.5 (high): intelligence 55.8 → 45.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.4 (xhigh): intelligence 53.1 → 42.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiMo-V2.5-Pro: intelligence 42.9 → 32.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.8-Flash-Next: intelligence 55.8 → 45.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Sonnet 5 (Adaptive Reasoning, Max Effort): intelligence 55.3 → 45.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-5.2 (max): intelligence 52.6 → 42.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 3.5 Flash (high): intelligence 52 → 41.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Inkling (xhigh): intelligence 42.3 → 32.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Muse Spark 1.2 (xhigh): intelligence 56.8 → 46.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V4 Flash Vision (Reasoning, Max Effort): intelligence 51.5 → 41.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Muse Spark 1.1 (xhigh): intelligence 53.2 → 43.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort): intelligence 48.4 → 38.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.6 Terra (max): intelligence 56.6 → 46.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 3.5 Flash-Lite: intelligence 37.4 → 27.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.7 Max: intelligence 46.7 → 37, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniMax-M3: intelligence 45.4 → 35.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.6 Sol (max): intelligence 60.9 → 51.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Agnes 2.5 Pro Beta: intelligence 49.1 → 39.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Kimi K3 (max): intelligence 59.7 → 50.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • K2 Horizon 375B A23B: intelligence 47.3 → 37.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V4 Pro (Reasoning, Max Effort): intelligence 45.3 → 35.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Muse Spark 1.3 (max): intelligence 62.1 → 52.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 3.1 Pro Preview: intelligence 47.7 → 38.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Motif 3: intelligence 47.4 → 38, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Kimi K2.6: intelligence 45.1 → 35.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Apodex 1.1: intelligence 44 → 34.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Kimi K2.7 Code: intelligence 43 → 33.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Quasar 438B (max, based on GLM-5.2): intelligence 43 → 33.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-5.1 (Reasoning): intelligence 41 → 31.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Opus 5 (Adaptive Reasoning, Max Effort): intelligence 63.1 → 54.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Hy3: intelligence 42.2 → 33.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V4 Flash (Reasoning, Max Effort): intelligence 42.1 → 33.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nex-N2-Pro: intelligence 41.7 → 32.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.4 mini (xhigh): intelligence 40.9 → 31.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok Build 0.1 0616: intelligence 40.7 → 31.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.6 Plus: intelligence 40.5 → 31.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback): intelligence 65.7 → 56.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback): intelligence 62.1 → 53.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.6 Luna (max): intelligence 52.3 → 43.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Solar Pro 4: intelligence 41.6 → 32.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Inkling Small: intelligence 41.2 → 32.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.4 nano (xhigh): intelligence 39.7 → 30.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniMax-M2.7: intelligence 38.9 → 30.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ling 3.0 Tiny: intelligence 24.5 → 15.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nemotron 3 Ultra 550B A55B (Reasoning): intelligence 38.3 → 29.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.6 27B (Reasoning): intelligence 37.7 → 29, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.3 Codex (xhigh): intelligence 45.5 → 36.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.7 Plus: intelligence 39.4 → 30.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 4.3 (high): intelligence 37.9 → 29.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Opus 4.6 (Adaptive Reasoning, Max Effort): intelligence 44.9 → 36.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Muse Spark: intelligence 44.3 → 35.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Agnes 2.5 Pro Alpha: intelligence 39.7 → 31.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiMo-V2.5: intelligence 38 → 29.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • gpt-oss-120b (high): intelligence 24.1 → 15.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.1 (high): intelligence 37.5 → 29.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 4.5 Sonnet (Reasoning): intelligence 37.4 → 29, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Solar Open2 250B: intelligence 37.4 → 29, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Kimi K2.5 (Reasoning): intelligence 36 → 27.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.2 (xhigh): intelligence 43.3 → 35, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Opus 4.5 (Reasoning): intelligence 41.9 → 33.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiMo-V2-Pro: intelligence 41.4 → 33.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-4.7 (Reasoning): intelligence 34.5 → 26.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • G9v3-39A5B: intelligence 34 → 25.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.2 Codex (xhigh): intelligence 41.2 → 33, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.6 Max Preview: intelligence 41.1 → 32.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 3 Pro Preview (high): intelligence 40.6 → 32.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-5 (Reasoning): intelligence 40.6 → 32.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5 (high): intelligence 35.3 → 27.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • A.X-K2: intelligence 35 → 26.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 397B A17B (Reasoning): intelligence 34.3 → 26.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LongCat 2.0: intelligence 34 → 25.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • JT-4.1 Flash 236B A21B: intelligence 39.9 → 31.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-5-Turbo: intelligence 39.1 → 31, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • KAT Coder Pro V2: intelligence 33.7 → 25.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 3 Flash Preview (Reasoning): intelligence 38.7 → 30.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 4.20 0309 v2 (Reasoning): intelligence 38 → 30, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 122B A10B (Reasoning): intelligence 32.8 → 24.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ring-2.6-1T: intelligence 31.7 → 23.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Step 3.7 Flash: intelligence 30.9 → 22.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 4.20 0309 (Reasoning): intelligence 37.4 → 29.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiMo-V2-Omni-0327: intelligence 37.3 → 29.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V3.1 Terminus (Reasoning): intelligence 31.4 → 23.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • K-EXAONE 2.0: intelligence 31 → 23.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5 Codex (high): intelligence 37 → 29.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiMo-V2-Omni: intelligence 35.9 → 28.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.1 Codex (high): intelligence 35.6 → 27.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM 5V Turbo (Reasoning): intelligence 35.3 → 27.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 27B (Reasoning): intelligence 34.6 → 26.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniMax-M2.5: intelligence 34.5 → 26.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Medium 3.5: intelligence 30.4 → 22.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 4.1 Opus (Reasoning): intelligence 34.5 → 26.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Hy3-preview (Reasoning): intelligence 34.4 → 26.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.5 Instant (May 2026): intelligence 34.3 → 26.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 4: intelligence 34.1 → 26.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiMo-V2-Flash (Feb 2026): intelligence 34 → 26.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Kimi K2 Thinking: intelligence 33.5 → 25.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • o3-pro: intelligence 33.3 → 25.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 4 Sonnet (Reasoning): intelligence 29.8 → 22.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-4.6 (Reasoning): intelligence 29.3 → 21.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V3.2 (Reasoning): intelligence 32.8 → 25.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Max Thinking: intelligence 32.5 → 25, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniMax-M2.1: intelligence 32.1 → 24.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 4 31B (Reasoning): intelligence 29.7 → 22.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 4 Opus (Reasoning): intelligence 31.7 → 24.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5 mini (medium): intelligence 31.6 → 24.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 4.1 Fast (Reasoning): intelligence 31.3 → 23.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • o3: intelligence 31.1 → 23.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 4.5 Haiku (Reasoning): intelligence 29.9 → 22.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5.1 Codex mini (high): intelligence 31.3 → 24, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 Omni Plus: intelligence 31.3 → 24, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 35B A3B (Reasoning): intelligence 29.9 → 22.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • JT-35B-Flash: intelligence 29 → 21.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • KAT-Coder-Pro V1: intelligence 28.9 → 21.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniMax-M2: intelligence 28.9 → 21.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.2 30B: intelligence 23.7 → 16.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nemotron 3.5 Lightning: intelligence 23.6 → 16.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Command A+: intelligence 22.8 → 15.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 4 Fast (Reasoning): intelligence 27.9 → 20.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 3.7 Sonnet (Reasoning): intelligence 27.6 → 20.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nemotron 3 Super 120B A12B (Reasoning): intelligence 25.7 → 18.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ling-2.6-1T: intelligence 26.6 → 19.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Doubao Seed Code: intelligence 26.5 → 19.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Step 3.5 Flash 2603: intelligence 26.5 → 19.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • o4-mini (high): intelligence 26.1 → 19.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mercury 2: intelligence 21.9 → 14.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 9B (Reasoning): intelligence 21.8 → 14.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Coder Next: intelligence 21.3 → 14.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 4 26B A4B (Reasoning): intelligence 26.1 → 19.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Step 3.5 Flash: intelligence 26 → 19.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V3.2 Exp (Reasoning): intelligence 25.9 → 19, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.5 Pro: intelligence 25.9 → 19, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 3.1 Flash-Lite: intelligence 25.6 → 18.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Max: intelligence 24.5 → 17.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Small 4 (Reasoning): intelligence 19.7 → 12.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.5 Flash Preview (Sep '25) (Reasoning): intelligence 24.2 → 17.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Kimi K2 0905: intelligence 24 → 17.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • o1: intelligence 23.9 → 17.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 235B A22B 2507 (Reasoning): intelligence 19.9 → 13.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.5 Pro Preview (Mar' 25): intelligence 23.4 → 16.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-4.7-Flash (Reasoning): intelligence 23.3 → 16.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 3 mini Reasoning (high): intelligence 22.9 → 16.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • K-EXAONE (Reasoning): intelligence 22.5 → 15.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • North Mini Code: intelligence 20.2 → 13.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Trinity Large Thinking: intelligence 18.7 → 12, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V3.2 Speciale: intelligence 22.6 → 16, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • ERNIE 5.0 Thinking Preview: intelligence 22.3 → 15.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 4 12B (Reasoning): intelligence 22.2 → 15.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nova 2.0 Pro Preview (medium): intelligence 22.1 → 15.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok Code Fast 1: intelligence 22 → 15.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Apriel-v1.5-15B-Thinker: intelligence 21.6 → 15, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V3.1 (Non-reasoning): intelligence 21.4 → 14.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nova 2.0 Omni (medium): intelligence 21.3 → 14.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek R1 (Jan '25): intelligence 18.6 → 12, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • HyperNova 60B 2605 (high, based on gpt-oss-120b): intelligence 18.3 → 11.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-6 Astra (max): intelligence 61.2 → 54.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 235B A22B (Reasoning): intelligence 20.9 → 14.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Apriel-v1.6-15B-Thinker: intelligence 20.8 → 14.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nova 2.0 Lite (high): intelligence 20.8 → 14.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • EXAONE 4.5 33B: intelligence 20.5 → 14, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek R1 0528 (May '25): intelligence 20.4 → 13.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 4B (Reasoning): intelligence 20.4 → 13.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Devstral 2: intelligence 19.2 → 12.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Devstral Small 2: intelligence 17.7 → 11.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.5 Flash (Reasoning): intelligence 20.3 → 13.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-5 nano (high): intelligence 20.1 → 13.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-4.5 (Reasoning): intelligence 19.7 → 13.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Kimi K2: intelligence 19.7 → 13.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-4.1: intelligence 19.6 → 13.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • JT-MINI: intelligence 18.8 → 12.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • o3-mini: intelligence 19.2 → 12.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 Omni Flash: intelligence 19.2 → 12.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • o1-pro: intelligence 19.1 → 12.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 3: intelligence 18.6 → 12.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Seed-OSS-36B-Instruct: intelligence 18.5 → 12.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 235B A22B 2507 Instruct: intelligence 18.4 → 12.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Coder 480B A35B Instruct: intelligence 18.2 → 11.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniMax M1 80k: intelligence 17.9 → 11.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nemotron Cascade 2 30B A3B: intelligence 17.8 → 11.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Small 3.1: intelligence 14.9 → 8.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Medium 3.1: intelligence 14.7 → 8.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ling 2.6 Flash: intelligence 14.2 → 7.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 32B (Reasoning): intelligence 18.1 → 11.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Magistral Medium 1.2: intelligence 18 → 11.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Sonar Reasoning Pro: intelligence 18 → 11.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • K2 Think V2: intelligence 17.4 → 11.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LongCat Flash Lite: intelligence 17.4 → 11.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • HyperCLOVA X SEED Think (32B): intelligence 17.2 → 11, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • o1-preview: intelligence 17.2 → 11, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-4.6V (Reasoning): intelligence 16.9 → 10.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Next 80B A3B (Reasoning): intelligence 16.9 → 10.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-4.5-Air: intelligence 16.7 → 10.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mi:dm K 2.5 Pro: intelligence 16.6 → 10.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Large 3: intelligence 15.9 → 9.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ring-1T: intelligence 16.3 → 10.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • G9v3-3B: intelligence 16.2 → 10.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • INTELLECT-3: intelligence 15.7 → 9.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • gpt-oss-20b (high): intelligence 15.2 → 9.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Celeris-1: intelligence 12.4 → 6.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V3 0324: intelligence 15.2 → 9.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning): intelligence 15.2 → 9.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 3 Reasoning Beta: intelligence 15.2 → 9.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Solar Open 100B (Reasoning): intelligence 15.2 → 9.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nemotron 3 Nano Omni 30B A3B Reasoning: intelligence 15 → 9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-4.1 mini: intelligence 14.8 → 8.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 30B A3B 2507 (Reasoning): intelligence 14.6 → 8.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 4 Maverick: intelligence 14.5 → 8.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniMax M1 40k: intelligence 14.5 → 8.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Solar Pro 3: intelligence 14.5 → 8.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 235B A22B Instruct: intelligence 14.4 → 8.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Next 80B A3B Instruct: intelligence 13.8 → 7.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.6 35B A3B (Reasoning): intelligence 32.1 → 26.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • NVIDIA Nemotron 3 Nano 30B A3B (Reasoning): intelligence 14.5 → 8.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V3 (Dec '24): intelligence 14.2 → 8.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • K2-V2 (high): intelligence 14.2 → 8.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • o1-mini: intelligence 14 → 8.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-4.5 (Preview): intelligence 13.6 → 7.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Coder 30B A3B Instruct: intelligence 13.6 → 7.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Tri-21B-think Preview: intelligence 13.6 → 7.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DiffusionGemma 26B A4B: intelligence 13.5 → 7.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 235B A22B (Reasoning): intelligence 13.5 → 7.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 30B A3B (Reasoning): intelligence 13.4 → 7.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • QwQ 32B: intelligence 13.4 → 7.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.0 Flash Thinking Experimental (Jan '25): intelligence 13.3 → 7.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Motif-2-12.7B-Reasoning: intelligence 12.8 → 7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ling-1T: intelligence 12.7 → 6.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nova Premier: intelligence 12.7 → 6.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Magistral Medium 1: intelligence 12.5 → 6.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Medium 3: intelligence 12.5 → 6.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Solar Pro 2 (Preview) (Reasoning): intelligence 12.5 → 6.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Devstral Medium: intelligence 12.4 → 6.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama Nemotron Super 49B v1.5 (Reasoning): intelligence 12.4 → 6.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-4o (March 2025, chatgpt-4o-latest): intelligence 12.3 → 6.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 4 E4B (Reasoning): intelligence 12.2 → 6.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.3 Nemotron Super 49B v1 (Reasoning): intelligence 12.2 → 6.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 3 Opus: intelligence 11.8 → 6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Devstral Small (May '25): intelligence 11.8 → 6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Magistral Small 1.2: intelligence 11.5 → 5.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.5 Flash-Lite (Reasoning): intelligence 11.4 → 5.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.2 8B: intelligence 19.6 → 13.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Tri-21B-Think: intelligence 12.3 → 6.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 3.5 Haiku: intelligence 12.2 → 6.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.0 Flash (Feb '25): intelligence 12.2 → 6.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniCPM5-1B (Reasoning): intelligence 11.9 → 6.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 4B 2507 (Reasoning): intelligence 11.9 → 6.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Sarvam 105B (high): intelligence 11.9 → 6.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.0 Pro Experimental (Feb '25): intelligence 11.8 → 6.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Sonar Reasoning: intelligence 11.6 → 5.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 32B (Reasoning): intelligence 11.4 → 5.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ministral 3 14B: intelligence 11.2 → 5.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek R1 Distill Qwen 32B: intelligence 11 → 5.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LFM2.5-2.6B: intelligence 11 → 5.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nanbeige4.1-3B: intelligence 11 → 5.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 32B Instruct: intelligence 11 → 5.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Small 3.2: intelligence 10.7 → 5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 4 Scout: intelligence 10.3 → 4.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Magistral Small 1: intelligence 10.6 → 5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • EXAONE 4.0 32B (Reasoning): intelligence 10.5 → 4.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 8B (Reasoning): intelligence 10.5 → 4.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 14B (Reasoning): intelligence 10.4 → 4.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek R1 0528 Qwen3 8B: intelligence 10.3 → 4.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen2.5 Max: intelligence 10.1 → 4.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 1.5 Pro (Sep '24): intelligence 9.9 → 4.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Hermes 4 - Llama-3.1 70B (Reasoning): intelligence 9.9 → 4.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 30B A3B Instruct: intelligence 9.9 → 4.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 3.5 Sonnet (Oct '24): intelligence 9.8 → 4.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek R1 Distill Llama 70B: intelligence 9.8 → 4.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek R1 Distill Qwen 14B: intelligence 9.7 → 4.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Falcon-H1R-7B: intelligence 9.7 → 4.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Sonar: intelligence 9.4 → 3.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.3 Instruct 70B: intelligence 9.3 → 3.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 30B A3B (Reasoning): intelligence 9.2 → 3.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-4.1 nano: intelligence 9.6 → 4.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ling-flash-2.0: intelligence 9.6 → 4.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 4 E2B (Reasoning): intelligence 9.5 → 4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Omni 30B A3B (Reasoning): intelligence 9.5 → 4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen2.5 Instruct 72B: intelligence 9.4 → 3.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Step3 VL 10B: intelligence 9.3 → 3.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • QwQ 32B-Preview: intelligence 9.1 → 3.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Sonar Pro: intelligence 9.1 → 3.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GLM-4.5V (Reasoning): intelligence 9 → 3.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ministral 3 8B: intelligence 9 → 3.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Large 2 (Nov '24): intelligence 9 → 3.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • ERNIE 4.5 300B A47B: intelligence 8.9 → 3.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.1 Nemotron Ultra 253B v1 (Reasoning): intelligence 8.9 → 3.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 30B A3B 2507 Instruct: intelligence 8.9 → 3.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • NVIDIA Nemotron Nano 12B v2 VL (Reasoning): intelligence 8.8 → 3.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.1 30B: intelligence 8.7 → 3.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • NVIDIA Nemotron Nano 9B V2 (Reasoning): intelligence 8.7 → 3.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • NVIDIA Nemotron 3 Nano 4B: intelligence 8.6 → 3.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Kimi Linear 48B A3B Instruct: intelligence 8.4 → 2.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning): intelligence 8.4 → 2.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 8B (Reasoning): intelligence 8.3 → 2.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 4B (Reasoning): intelligence 8.2 → 2.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Pixtral Large: intelligence 8 → 2.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Hermes 4 - Llama-3.1 405B (Reasoning): intelligence 8.8 → 3.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 2.0 Flash-Lite (Feb '25): intelligence 8.6 → 3.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.1 Instruct 405B: intelligence 8.3 → 2.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 8B Instruct: intelligence 8.2 → 2.8, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LFM2.5-8B-A1B: intelligence 8.1 → 2.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.1 Tulu3 405B: intelligence 8.1 → 2.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ring-flash-2.0: intelligence 8 → 2.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Olmo 3.1 32B Think: intelligence 7.9 → 2.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 1.5 Flash (Sep '24): intelligence 7.8 → 2.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok 2 (Dec '24): intelligence 7.8 → 2.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-4 Turbo: intelligence 7.7 → 2.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 4B (Reasoning): intelligence 7.7 → 2.3, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nova Pro: intelligence 7.5 → 2.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 3 27B Instruct: intelligence 7.4 → 2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.1 Instruct 8B: intelligence 7.4 → 2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok Beta: intelligence 7.3 → 1.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ministral 3 3B: intelligence 7.1 → 1.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.1 Nemotron Instruct 70B: intelligence 7.4 → 2.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3.5 2B (Reasoning): intelligence 7.4 → 2.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen2.5 Instruct 32B: intelligence 7.2 → 1.9, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen2.5 Coder Instruct 32B: intelligence 6.9 → 1.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 4B 2507 Instruct: intelligence 6.9 → 1.6, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-4: intelligence 6.8 → 1.5, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-4o mini: intelligence 6.7 → 1.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Small 3: intelligence 6.7 → 1.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nova Lite: intelligence 6.7 → 1.4, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek-V2.5 (Dec '24): intelligence 6.5 → 1.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.1 Instruct 70B: intelligence 6.5 → 1.2, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.1 8B: intelligence 6.4 → 1.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Sarvam 30B (high): intelligence 6.4 → 1.1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek R1 Distill Llama 8B: intelligence 6.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Saba: intelligence 6.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Olmo 3.1 32B Instruct: intelligence 6.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Olmo 3 32B Think: intelligence 6.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.2 Instruct 90B (Vision): intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen2.5 Turbo: intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • R1 1776: intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Reka Flash (Sep '24): intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Solar Mini: intelligence 6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Grok-1: intelligence 5.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Phi-4 Mini Instruct: intelligence 5.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen2 Instruct 72B: intelligence 5.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 3 12B Instruct: intelligence 5.5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 1.5 Flash-8B: intelligence 5.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepHermes 3 - Mistral 24B Preview (Non-reasoning): intelligence 5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Jamba 1.7 Large: intelligence 5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.0 H Small: intelligence 4.9 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Hermes 3 - Llama-3.1 70B: intelligence 4.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Jamba 1.5 Large: intelligence 4.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 Omni 30B A3B Instruct: intelligence 4.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek-Coder-V2: intelligence 4.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Jamba 1.6 Large: intelligence 4.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • OLMo 2 32B: intelligence 4.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.2 3B: intelligence 14.3 → 10.7, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LFM2 24B A2B: intelligence 4.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Phi-4: intelligence 4.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 3 Sonnet: intelligence 4.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.1 3B: intelligence 4.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Nova Micro: intelligence 4.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 1.0 Ultra: intelligence 4.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Phi-3 Mini Instruct 3.8B: intelligence 4.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 3n E4B Instruct Preview (May '25): intelligence 4.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Phi-4 Multimodal Instruct: intelligence 4.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Large (Feb '24): intelligence 4.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen2.5 Coder Instruct 7B : intelligence 4.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mixtral 8x22B Instruct: intelligence 4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 2 Chat 7B: intelligence 3.9 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.2 Instruct 3B: intelligence 3.9 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Jamba Reasoning 3B: intelligence 3.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • MiniCPM-V 4.6 1.3B: intelligence 3.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen1.5 Chat 110B: intelligence 3.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen3 VL 4B Instruct: intelligence 3.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Reka Flash 3: intelligence 3.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Olmo 3 7B Think: intelligence 3.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 2.1: intelligence 3.5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 3 Haiku: intelligence 3.5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • OLMo 2 7B: intelligence 3.5 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Ling-mini-2.0: intelligence 3.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Molmo 7B-D: intelligence 3.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude 2.0: intelligence 3.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek R1 Distill Qwen 1.5B: intelligence 3.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek-V2-Chat: intelligence 3.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • GPT-3.5 Turbo: intelligence 3.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral Medium: intelligence 3.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3 Instruct 70B: intelligence 3.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Arctic Instruct: intelligence 3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LFM 40B: intelligence 3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 3.2 Instruct 11B (Vision): intelligence 3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen Chat 72B: intelligence 3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • PALM-2: intelligence 2.8 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek Coder V2 Lite Instruct: intelligence 2.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemini 1.0 Pro: intelligence 2.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Command-R+ (Apr '24): intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DBRX Instruct: intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepSeek LLM 67B Chat (V1): intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 2 Chat 13B: intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 2 Chat 70B: intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • OpenChat 3.5 (1210): intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Sarvam M (Reasoning): intelligence 2.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Olmo 3 7B Instruct: intelligence 2.4 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Jamba 1.5 Mini: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Jamba 1.7 Mini: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LFM2 2.6B: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LFM2.5-1.2B-Instruct: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • LFM2.5-1.2B-Thinking: intelligence 2.3 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.0 H 1B: intelligence 2.2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Jamba 1.6 Mini: intelligence 2.1 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Apertus 70B Instruct: intelligence 2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Gemma 3 270M: intelligence 2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.0 Micro: intelligence 2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mixtral 8x7B Instruct: intelligence 2 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning): intelligence 1.9 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Claude Instant: intelligence 1.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Llama 65B: intelligence 1.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Mistral 7B Instruct: intelligence 1.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Qwen Chat 14B: intelligence 1.7 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Granite 4.0 1B: intelligence 1.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.
  • Molmo2-8B: intelligence 1.6 → 1, men indekset er bumpet 4.1 → 4.2 — tallene er ikke sammenlignelige med i går.

Ny i HF-trending

  • fanuonai/ice-012-audio er ny i Hugging Faces trending (score 56).
  • IFM/K2-Horizon-375B-A23B er ny i Hugging Faces trending (score 48).
  • facebook/sam3.1 er ny i Hugging Faces trending (score 41).
  • black-forest-labs/FLUX.2-klein-base-9b-fp8 er ny i Hugging Faces trending (score 38, 1 derivater).
  • ByteDance/Ouro-1.4B er ny i Hugging Faces trending (score 37).

Intelligence Index — Artificial Analysis

#ModelIntel.Agentic CreatorUdgivet
1 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 5 effort-varianter 56.8 58.2 Anthropic 2026-09-01
2 GPT-6 Astra (max) 6 effort-varianter 54.7 51.6 OpenAI 2026-09-03
3 Claude Opus 5 (Adaptive Reasoning, Max Effort) 5 effort-varianter 54.1 56.4 Anthropic 2026-07-24
4 Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) 53.2 51.2 Anthropic 2026-06-09
5 Muse Spark 1.3 (max) 2 effort-varianter 52.7 55.6 Meta 2026-09-02
6 GPT-5.6 Sol (max) 6 effort-varianter 51.3 50.7 OpenAI 2026-07-09
7 Grok 4.6 (high) 4 effort-varianter 50.6 53.6 SpaceXAI 2026-08-12
8 Kimi K3 (max) 2 effort-varianter ⬇ hf.co/moonshotai/Kimi-K3 50.2 50.9 Kimi 2026-07-16
9 GLM-5.3 (max) ⬇ hf.co/zai-org/GLM-5.3 48.6 53.6 Z AI 2026-08-18
10 Gemini 3.8 Flash (high) 3 effort-varianter 47.1 41.2 Google 2026-09-02
11 Qwen3.8 Max 46.9 49.9 Alibaba 2026-08-03
12 GPT-5.6 Terra (max) 6 effort-varianter 46.8 43.9 OpenAI 2026-07-09
13 Muse Spark 1.2 (xhigh) 46.8 44.2 Meta 2026-08-05
14 Qwen3.8 2.4T A95B ⬇ hf.co/Qwen/Qwen3.8-2.4T-A95B 46.7 50.7 Alibaba 2026-08-12
15 Claude Opus 4.8 (Adaptive Reasoning, Max Effort) 46.4 42.8 Anthropic 2026-05-28
16 GLM-5.3-Flash ⬇ hf.co/zai-org/GLM-5.3-Flash 46.2 51.5 Z AI 2026-08-26
17 GPT-5.5 (xhigh) 5 effort-varianter 45.6 37.5 OpenAI 2026-04-23
18 Qwen3.8-Flash-Next ⬇ hf.co/Qwen/Qwen3.8-Flash-Next 45.6 Alibaba 2026-08-26
19 Grok 4.5 (high) 45.5 42.4 SpaceXAI 2026-07-08
20 Gemini 3.7 Flash (high) 3 effort-varianter 45.2 36.6 Google 2026-08-13
21 Claude Sonnet 5 (Adaptive Reasoning, Max Effort) 6 effort-varianter 45.1 44.5 Anthropic 2026-06-30
22 Claude Opus 4.7 (Adaptive Reasoning, Max Effort) 2 effort-varianter 44.3 39.7 Anthropic 2026-04-16
23 GPT-5.6 Luna (max) 6 effort-varianter 43.4 42.9 OpenAI 2026-07-09
24 Muse Spark 1.1 (xhigh) 43.3 27.8 Meta 2026-07-09
25 GPT-5.4 (xhigh) 3 effort-varianter 42.8 OpenAI 2026-03-05
26 GLM-5.2 (max) 2 effort-varianter ⬇ hf.co/zai-org/GLM-5.2 42.5 39.7 Z AI 2026-06-16
27 DeepSeek V4 Pro 0813 (Reasoning, Max Effort) ⬇ hf.co/deepseek-ai/DeepSeek-V4-Pro 42.1 42.5 DeepSeek 2026-08-13
28 Gemini 3.5 Flash (high) 3 effort-varianter 41.9 27.4 Google 2026-05-19
29 Qwen3.8 27B (xhigh) 4 effort-varianter ⬇ hf.co/Qwen/Qwen3.8-27B 41.6 46.8 Alibaba 2026-08-14
30 DeepSeek V4 Flash Vision (Reasoning, Max Effort) 41.5 DeepSeek 2026-08-21
31 DeepSeek V4 Flash 0731 (Reasoning, Max Effort) ⬇ hf.co/deepseek-ai/DeepSeek-V4-Flash-0731 40.8 41.9 DeepSeek 2026-07-31
32 Gemini 3.6 Flash (high) 40.3 30.3 Google 2026-07-21
33 Agnes 2.5 Pro Beta 39.5 Sapiens AI 2026-08-26
34 Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) 3 effort-varianter 38.5 33.3 Anthropic 2026-02-17
35 Gemini 3.1 Pro Preview 38.3 10.4 Google 2026-02-19
36 Motif 3 2 effort-varianter ⬇ hf.co/Motif-Technologies/Motif-3 38 Motif Technologies 2026-08-12
37 K2 Horizon 375B A23B ⬇ hf.co/IFM/K2-Horizon-375B-A23B 37.8 41.2 MBZUAI Institute of Foundation Models 2026-09-03
38 Qwen3.7 Max 37 23.9 Alibaba 2026-05-19
39 GPT-5.3 Codex (xhigh) 36.9 OpenAI 2026-02-05
40 Claude Opus 4.6 (Adaptive Reasoning, Max Effort) 2 effort-varianter 36.4 Anthropic 2026-02-05

Hugging Face — trending familier

#Rod-repoTrendingLikes DownloadsParamsAlder
1 deepseek-ai/DeepSeek-V4-Flash-Vision-Exp +1 derivater 564 608 133024 304.6B 5 d
2 Qwen/Qwen3.8-27B +17 derivater 549 13963 5739341 27.8B 31 d
3 Qwen/Qwen3.8-Flash-Next +5 derivater 534 4880 351374 180.0B 12 d
4 zai-org/GLM-5.3 455 1705 303534 753.3B 11 d
5 zai-org/GLM-5.3-Flash +3 derivater 445 2053 654957 321.3B 11 d
6 XHToken/Spark-X2.5-4B-Base +2 derivater 392 478 3524 4.1B 12 d
7 google/timesfm-3.0-pytorch 388 432 105304 330.7M 11 d
8 Lightricks/LTX-2.5 376 2793 1399511 44 d
9 BreezeBlue/Breeze-TTS-2 260 434 5388 3.5B 10 d
10 MiniMaxAI/MiniMax-H3 +9 derivater 245 4911 5118457 33.1B 39 d
11 nreimers/MiniLM-L6-H384-uncased +1 derivater 226 5519 253789790 22.7M 1647 d
12 openai-community/gpt2 222 3661 14607268 137.0M 1647 d
13 google-bert/bert-base-uncased 197 2951 58675189 110.1M 1647 d
14 facebook/mms-300m 194 237 12823 1201 d
15 FastVideo/FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree 192 277 0 35.0B 9 d

Params er safetensors.total, altså lagrede vægte inklusive kvantiserede tensorer — ikke et mål for hvad modellen kræver af hardware.