News-Tracker

Modeller

AI & LLM · daglig briefing


Ændringer siden forrige snapshot

Ny i indekset

  • DeepSeek V4 Pro (Reasoning, High Effort) er ny i Artificial Analysis' indeks (intelligence 34.6, DeepSeek).
  • MiniCPM5-2B er ny i Artificial Analysis' indeks (intelligence 15, OpenBMB).

Score ændret

  • DeepSeek V4 Flash (Reasoning, Max Effort): intelligence 33.1 → 30.7, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Qwen3 32B (Reasoning): intelligence 5.7 → 8, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Qwen3 14B (Reasoning): intelligence 4.8 → 7.1, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Gemini 3.5 Flash (high): intelligence 41.9 → 39.7, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Muse Spark 1.1 (xhigh): intelligence 43.3 → 41.2, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V3 (Dec '24): intelligence 8.3 → 10.4, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Llama 4 Maverick: intelligence 8.5 → 10.3, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Claude 4.5 Sonnet (Reasoning): intelligence 29 → 27.3, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • gpt-oss-20b (high): intelligence 9.1 → 10.8, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Mistral Small 3.1: intelligence 8.6 → 10.3, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Claude Opus 4.8 (Adaptive Reasoning, Max Effort): intelligence 46.4 → 47.8, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • MiMo-V2.5: intelligence 29.5 → 28.2, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Celeris-1: intelligence 6.3 → 7.6, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Kimi K2.7 Code: intelligence 33.9 → 32.7, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Qwen3.7 Plus: intelligence 30.8 → 31.9, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Trinity Large Thinking: intelligence 12 → 13.1, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Solar Pro 3: intelligence 8.5 → 9.4, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • DeepSeek V4 Flash Vision (Reasoning, Max Effort): intelligence 41.5 → 40.7, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Hy3: intelligence 33.2 → 32.4, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Grok 4.3 (high): intelligence 29.3 → 29.9, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Gemini 3.1 Flash-Lite: intelligence 18.7 → 19.3, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.
  • Devstral Small 2: intelligence 11.2 → 11.7, men indekset er bumpet 4.2 → 4.3 — tallene er ikke sammenlignelige med i går.

Ny i HF-trending

  • openbmb/MiniCPM5-2B er ny i Hugging Faces trending (score 293, 1 derivater).

Intelligence Index — Artificial Analysis

#ModelIntel.Agentic CreatorUdgivet
1 Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) 5 effort-varianter 56.8 58.2 Anthropic 2026-09-01
2 GPT-6 Astra (max) 6 effort-varianter 54.7 51.6 OpenAI 2026-09-03
3 Claude Opus 5 (Adaptive Reasoning, Max Effort) 5 effort-varianter 54.1 56.4 Anthropic 2026-07-24
4 Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) 53.2 51.2 Anthropic 2026-06-09
5 Muse Spark 1.3 (max) 2 effort-varianter 53 55.6 Meta 2026-09-02
6 GPT-5.6 Sol (max) 6 effort-varianter 51.3 50.7 OpenAI 2026-07-09
7 Grok 4.6 (high) 4 effort-varianter 50.6 53.6 SpaceXAI 2026-08-12
8 Kimi K3 (max) 2 effort-varianter ⬇ hf.co/moonshotai/Kimi-K3 50.2 50.9 Kimi 2026-07-16
9 GLM-5.3 (max) ⬇ hf.co/zai-org/GLM-5.3 48.6 53.6 Z AI 2026-08-18
10 Claude Opus 4.8 (Adaptive Reasoning, Max Effort) 47.8 42.8 Anthropic 2026-05-28
11 Gemini 3.8 Flash (high) 3 effort-varianter 47.1 41.2 Google 2026-09-02
12 Qwen3.8 Max 46.9 49.9 Alibaba 2026-08-03
13 GPT-5.6 Terra (max) 6 effort-varianter 46.8 43.9 OpenAI 2026-07-09
14 Muse Spark 1.2 (xhigh) 46.8 44.2 Meta 2026-08-05
15 Qwen3.8 2.4T A95B ⬇ hf.co/Qwen/Qwen3.8-2.4T-A95B 46.7 50.7 Alibaba 2026-08-12
16 GLM-5.3-Flash ⬇ hf.co/zai-org/GLM-5.3-Flash 46.2 51.5 Z AI 2026-08-26
17 GPT-5.5 (xhigh) 5 effort-varianter 45.6 37.5 OpenAI 2026-04-23
18 Qwen3.8-Flash-Next ⬇ hf.co/Qwen/Qwen3.8-Flash-Next 45.6 Alibaba 2026-08-26
19 Grok 4.5 (high) 45.5 42.4 SpaceXAI 2026-07-08
20 Gemini 3.7 Flash (high) 3 effort-varianter 45.2 36.6 Google 2026-08-13
21 Claude Sonnet 5 (Adaptive Reasoning, Max Effort) 6 effort-varianter 45.1 44.5 Anthropic 2026-06-30
22 Claude Opus 4.7 (Adaptive Reasoning, Max Effort) 2 effort-varianter 44.3 39.7 Anthropic 2026-04-16
23 GPT-5.6 Luna (max) 6 effort-varianter 43.4 42.9 OpenAI 2026-07-09
24 GPT-5.4 (xhigh) 3 effort-varianter 42.8 OpenAI 2026-03-05
25 DeepSeek V4 Pro 0813 (Reasoning, Max Effort) ⬇ hf.co/deepseek-ai/DeepSeek-V4-Pro 42.1 42.5 DeepSeek 2026-08-13
26 GLM-5.2 (max) 2 effort-varianter ⬇ hf.co/zai-org/GLM-5.2 42.1 39.7 Z AI 2026-06-16
27 Qwen3.8 27B (xhigh) 4 effort-varianter ⬇ hf.co/Qwen/Qwen3.8-27B 41.4 46.8 Alibaba 2026-08-14
28 Muse Spark 1.1 (xhigh) 41.2 27.8 Meta 2026-07-09
29 DeepSeek V4 Flash 0731 (Reasoning, Max Effort) ⬇ hf.co/deepseek-ai/DeepSeek-V4-Flash-0731 40.8 41.9 DeepSeek 2026-07-31
30 DeepSeek V4 Flash Vision (Reasoning, Max Effort) 40.7 48.2 DeepSeek 2026-08-21
31 Gemini 3.6 Flash (high) 40.3 30.3 Google 2026-07-21
32 Gemini 3.5 Flash (high) 3 effort-varianter 39.7 27.4 Google 2026-05-19
33 Agnes 2.5 Pro Beta 39.5 Sapiens AI 2026-08-26
34 Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) 3 effort-varianter 38.5 33.3 Anthropic 2026-02-17
35 Motif 3 2 effort-varianter ⬇ hf.co/Motif-Technologies/Motif-3 38 Motif Technologies 2026-08-12
36 K2 Horizon 375B A23B ⬇ hf.co/IFM/K2-Horizon-375B-A23B 37.8 41.2 MBZUAI Institute of Foundation Models 2026-09-03
37 GPT-5.3 Codex (xhigh) 36.9 OpenAI 2026-02-05
38 Gemini 3.1 Pro Preview 36.7 10.4 Google 2026-02-19
39 Qwen3.7 Max 36.6 23.9 Alibaba 2026-05-19
40 Claude Opus 4.6 (Adaptive Reasoning, Max Effort) 2 effort-varianter 36.4 Anthropic 2026-02-05

Hugging Face — trending familier

#Rod-repoTrendingLikes DownloadsParamsAlder
1 XHToken/Spark-X2.5-4B-Base +2 derivater 622 745 7216 4.1B 15 d
2 Qwen/Qwen3.8-27B +17 derivater 525 14281 6416358 27.8B 34 d
3 google/timesfm-3.0-pytorch 466 580 271713 330.7M 14 d
4 Lightricks/LTX-2.5 361 3089 1584382 47 d
5 Qwen/Qwen3.8-Flash-Next +4 derivater 340 4982 474693 180.0B 15 d
6 deepseek-ai/DeepSeek-V4-Flash-Vision-Exp +1 derivater 334 801 251611 304.6B 8 d
7 openbmb/MiniCPM5-2B +1 derivater 293 315 13 2.5B 2 d
8 zai-org/GLM-5.3-Flash +2 derivater 257 2135 784005 321.3B 14 d
9 zai-org/GLM-5.3 +1 derivater 233 1753 442064 753.3B 14 d
10 OpenVDN/vdn-minimax-h3 220 227 0 6 d
11 MiniMaxAI/MiniMax-H3 +11 derivater 219 5013 4990034 33.1B 42 d
12 nreimers/MiniLM-L6-H384-uncased +1 derivater 211 5577 251367312 22.7M 1650 d
13 IFM/K2-Horizon-MoVA-36B-A4B +1 derivater 205 211 2226 37.4B 6 d
14 openai-community/gpt2 204 3716 14629637 137.0M 1650 d
15 BreezeBlue/Breeze-TTS-2 199 478 6754 3.5B 13 d

Params er safetensors.total, altså lagrede vægte inklusive kvantiserede tensorer — ikke et mål for hvad modellen kræver af hardware.