Søgning
5 research-rapport(er) for »local-ai«
hvilke 120b modeller er der kommet og hvordan klarer de sig .... det er vist den range af modeller som er bedst til 128gb memory til lokal hosting
… parameter AI model on a budget GPU](https://cybernews.com/editorial/moe-lets-users-run-massive-llms-on-consumer-hardware/) 9. [r/LocalLLaMA on …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… The Sweet Spot for Local Dev (Guide) | QWE AI Academy](https://www.qwe.edu.pl/tutorial/qwen-3-6-27b-local-development-sweet-spot …
Qwen 3.8 27b
… Flagship-Level Coding in a 27B Dense Model](https://qwen.ai/blog?id=qwen3.6-27b) 6. [Qwen3.6 - How to Run Locally | Unsloth …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… The Sweet Spot for Local Dev (Guide) | QWE AI Academy](https://www.qwe.edu.pl/tutorial/qwen-3-6-27b-local-development-sweet-spot …
Mac Studio M5 hvornår kommer den? båndbredde på hukommelsen? og hvad med rygtet omkring at M6 springes over og de går til M7 i stedet og går efter højere memory båndbredde?
… Årsagen angives at være et strategisk skift mod AI-fokuserede chips: M7-generationen skal have en meget større vægt på AI-behandling [11][13 …
50 briefing-resultat(er) for »local-ai«
Xi Jinping foreslår open-source AI-zone for BRICS-lande
Kina vil lede oprettelsen af en open-source AI-sfære blandt BRICS-nationer, som et modsvar til vestlig dominans. Forslaget møder både interesse og …
Open source-miljøet skeptisk over for AI-dommedagsfortællinger
På r/LocalLLaMA stiller brugere spørgsmålstegn ved, om advarslerne om AI-overtagelse er ægte eller markedsføring for regulering. Debatten afspejler en kløft mellem open …
Muse Glimmer: Overset samtale-model der føles naturlig
Brugere på r/LocalLLaMA roser Muse Glimmer for at føre dybe, menneskelige samtaler uden AI-klichéer. Modellen skiller sig ud som en af de …
Hvad med defensiv AI? Overvågning som modsvar til AI-hackere
En Reddit-bruger foreslår at bruge AI til at overvåge netværkstrafik og alarmere ved mistænkelig adfærd, i stedet for kun at fokusere på lovgivning …
DeepSeek-ingeniør reflekterer over AI's hastige fremskridt og egen rolle
En DeepSeek-ingeniør beskriver, hvordan AI på få år er gået fra simpel chat til at optimere sine egne operatører. Han udtrykker både stolthed …
Open source i skudlinjen: "Retten til intelligens" skal forsvares
… Et nyt opslag på r/LocalLLaMA opfordrer til at beskytte retten til at køre lokal AI.
Trump: "Negative kræfter" bag AI-sikkerhed – USA skal vinde kapløbet
Præsident Trump gentager sin afvisning af AI-nedbremsning og kalder sikkerhedsadvarsler for "negative kræfter". Han understreger, at "den, der vinder med AI, vinder alt …
Real-SWE: Nyt benchmark tester AI på private virksomhedskodebaser
Benchmarket evaluerer modeller på rigtige, private enterprise-kodebaser frem for syntetiske opgaver. Diskuteres på Hacker News og r/LocalLLaMA.
Kan AI-inferenceudbydere overhovedet tjene penge?
Debat på r/LocalLLaMA afslører, at udbydere med 10.000 USD månedlig omsætning kun beholder 200 USD i profit – GPU-omkostninger æder alt.
Opfølgning: 22 tokens/sek – Qwen3.8 Flash Next på 32GB MacBook Air
Cherenkov-inference engine slår rekord på Apple Silicon ved at streame eksperter prædiktivt fra SSD og falde tilbage til lavere kvantisering ved pres. [Se …
Udvikler: Modellerne er fine, værktøjerne er problemet
En erfaren udvikler beskriver, hvordan AI-harness og konteksthåndtering skaber en 'slop-spiral' med bugs. Han mener, at modeller som Qwen3.8-27B er …
Nyt benchmark: The Struggle Bench – kan AI'en overleve i en lejlighed?
Modellen får en server, en lejlighed og en bankkonto. Den skal betale husleje uden at begå cyberkriminalitet. Score: antal måneder den overlever.
Benchmarks fra 4x Radeon AI Pro R9700-builds efterspurgt
En bruger overvejer en 4x R9700-server til DeepSeek V4 Flash og Qwen 3.8 Flash og spørger om erfaringer.
Bedste model og setup til remote deployment uden internet
… Budget 5.000 USD, overvejer AMD AI Pro 9700.
2x R9700 og 64 GB DDR5 – en "beast" til lokal inferens
Bruger rapporterer gode resultater med Qwen 3.8 27B og Flash Next på et ASUS ProArt-kort med to Radeon AI Pro R9700.
Bosgame Gorgon Halo: 192 GB RAM mini-pc i oktober
Bosgame lancerer Gorgon Halo i oktober med AMD Ryzen AI Max Pro 495 og op til 192 GB RAM. 128 GB-udgaven koster 3 …
Hvor meget VRAM til lokalt dokumentmanagement?
Debat i r/LocalLLaMA: rækker 8-12 GB VRAM til paperless-ai, når man vil stille spørgsmål til egne dokumenter? Fællesskabet peger på 6 …
NVIDIA PAIR: Byg en personlig AI-klynge af din gamle hardware
Reddit-brugeren deler NVIDIAs nye PAIR-koncept, der samler eksisterende enheder til én lokal AI-klynge. Fart og ydeevne er stadig uafklaret, men idéen …
Opfølgning: 21 kvantvarianter af Qwen3.8 27B benchmarket på 16 GB VRAM
Bartowski IQ4_XS var bedst samlet, huihui-ai abliterated bedst uncensored; KLD-målingerne viser stor kvalitetsspredning mellem kvants. Valg af kvant betyder mere end …
Sanders vil forbyde AI og true med 20 års fængsel
Den nye Sanders-Casar Act vil forbyde AI, der overstiger menneskelige kognitive evner, med fængselsstraf for overtrædelse. Forslaget viser en voksende politisk vilje til …
ChatGPT, Claude og Grok nede samtidig – lokal AI kan ikke slås fra
Alle tre store AI-tjenester havde udfald på samme tid, hvilket fik Hacker News og r/LocalLLaMA til at spekulere i fælles infrastruktur. Debatten …
NVIDIA satser på lokal AI og agenter på IFA 2026
… Budskabet er, at fremtidens AI kører hjemme på egen hardware.
Asus Ascent GX10 stiger 50% i pris – DGX Spark næste?
Prisen på Asus’ AI-supercomputer hopper til $5999, hvilket vækker spekulation om, at Nvidias DGX Spark snart følger trop.
Opfølgning: Import AI 471: Hugging Face bekymrer, DeepSeek V4 Flash Vision udkommer
Jack Clarks nyhedsbrev dykker ned i sikkerhedsbekymringer efter Hugging Face-hacket, mens Ethan Mollick skriver om agenter. Samtidig er DeepSeek V4 Flash Vision med …
Reddit spekulerer i NVIDIA-prisfastsættelse: RAM købt til 1/5 af spotpris
En artikel afslører, at Samsung har låst 70% af sin AI-hukommelse til Microsoft, Google og NVIDIA – NVIDIA betaler $300-500 per enhed mod …
Findes der en god lokal voice-to-voice-model til forbrugergrafikkort?
… Svaret er endnu uklart, men efterspørgslen viser, at community venter på et lokalt alternativ til ChatGPT Voice og Sesame AI.
Opfølgning: Bill Gates advarer om, at AI kan få mange job til at forsvinde for altid
Gates advarer om, at AI kan eliminere store jobkategorier, og at der ikke er nogen plan for, hvad der så skal ske. Han arbejder …
GLM-5.3-Flash: 320B parametre, 1M kontekst og hybrid attention
Den officielle megatråd bekræfter, at modellen har 320B parametre (18B aktive), 1M tokens kontekstvindue og en ny hybrid sparse/linear attention. Den er trænet …
Fællesskabet opfordrer til at seede AI-modeller via torrent som alternativ til Hugging Face
I lyset af Nvidias planlagte opkøb af Hugging Face opfordrer brugere til at bruge P2P-netværk til distribution af open-weight-modeller. Teknisk set …
Opfølgning: Hugging Face angiveligt til salg for $13 mia.
Efter OpenRouter blev købt af Stripe, spekuleres der i, om Apple kan købe "AI'ens GitHub" – Hugging Face – for at styrke lokal AI.
Xiaomi AI Cube: 1,2 TB/s hukommelsesbåndbredde i prototype
Xiaomi annoncerer AI Cube med tre chips – Xuanjie O3, O100 og D100 – hvor O100 leverer imponerende 1,22 TB/s båndbredde, muligvis SRAM.
Opfølgning: Apple Neural Engine – hvad kører egentlig?
Målinger viser, at placering på ANE afhænger af *hvordan* en beregning udtrykkes, ikke *hvad* den beregner – fp16-modeller kan blive CPU-låst.
JetBrains satser på lokal AI med Qwen3.6 27B
JetBrains optimerer deres IDE til lokal AI og har valgt Qwen3.6 27B frem for Qwen3.8 på grund af behovet for tænkning.
Nyt community: Lokal AI på gammel hardware
r/LowEndLocalAI er skabt til at køre LLM'er på normale laptops, integreret grafik og begrænset VRAM – med fokus på praktiske workflows.
MTP nu understøttet i GLM-4.5-Air via llama.cpp
Multi-Token Prediction (MTP) er tilføjet til GLM-4.5-Air (106B MoE, 12B aktiv) i llama.cpp, hvilket giver markant speedup – ideelt til …
Nvidia-kunder informeret om AI-relaterede prisstigninger på over 15%
En tråd på r/LocalLLaMA rapporterer, at Nvidia har meddelt kunder om prisstigninger på over 15% på AI-hardware – en udvikling der kan påvirke …
Liquid AI forbereder 100B-model – hurtigste arkitektur?
Liquid AI, kendt for de hurtigste LLM-arkitekturer og stærke SLM’er, varsler via en afstemning på X en kommende 100B-parameter LFM-model …
Ox Alpha – gratis stealth-model med 1M kontekst i en uge
Modellen, hvis oprindelse er ukendt, tilbydes gratis på tværs af OpenCode, Command Code og OpenRouter med 100T tokens/dag og nul datalagring.
PI Agent overgår OpenCode med Qwen3.8 27B – færre tokens, færre fejl
I en direkte sammenligning brugte PI Agent mindre kontekst, frøs ikke og komprimerede senere end OpenCode. Vision-modul anbefales. [Se tidligere dækning](/archive/2026 …
Qwen3.8 27B i 3bit på MacBook Air: 63 timer – men flysimulatoren virkede
… Google AI Studio klarede det på 20 minutter, men lokalt var det muligt.
Opfølgning: PI Agent overgår Opencode med Qwen3.8 27B
Bruger finder, at PI Agent giver bedre resultater end Opencode med samme model, samtidig med lavere tokenforbrug. [briefingen 8. august](/archive/2026-08-08).
Qwen 3.8 27B matcher GPT-5.6 Luna – på en brøkdel af parametrene
Qwen 3.8 27B scorer 52 på Artificial Analysis Intelligence Index, samme score som GPT-5.6 Luna (max) og kun ét point efter …
Lokal AI når GPT-4-niveau i 2027 – en forudsigelse baseret på acceleration
En analyse af frontier-to-local-tidslinjen forudsiger, at en ~30B open-weight-model vil matche GPT-4's evner allerede i januar 2027 …
USA: Partnere skal vælge side i AI-kapløbet mod Kina
USA vil bede sine partnere om at vælge side i AI-kapløbet mod Kina. Det kan tvinge virksomheder til at fravælge kinesiske modeller og …
Anthropic, OpenAI, Google, Meta, Microsoft og Mistral underskriver EU's adfærdskodeks for AI-vandmærkning
Alle store AI-udviklere har underskrevet EU's Code of Practice for gennemsigtighed af AI-genereret indhold. Det betyder, at selv open-weight lokale …
De små åbne modeller er mere skræmmende for OpenAI end de store – argumenterer Reddit-fællesskabet
… r/LocalLLaMA argumenterer for, at tippepunktet, hvor en bærbar kan køre en model, der klarer 90 % af ens arbejde, vil sprænge AI-boblen. OpenAI …
Fællesskabet udgiver optimerede Muse Glimmer 30B-quants – SoTA i hukommelsesklassen
… Søger praktikplads i AI-agent-orchestrering.
"10-års skraldekort" kører lokale LLMs – hvad kan man egentlig med et Nvidia 1060 3GB?
En Reddit-bruger eksperimenterer med at køre moderne ~7B-parametermodeller på et gammelt Nvidia 1060 3GB-kort via CPU-offloading og Kubernetes. Brugeren planlægger …
Muse Glimmer: Metas 30B open-weight agent-model kører på én GPU
… SWE-Bench og DeepSearch QA, og Mark Zuckerberg fulgte op med et manifest, der argumenterer for open-weight som modvægt til centraliseret AI-magt.
Opfølgning: MiniMax H3 leverer 2K-video med stereo lyd på open weights
… Men lokal kørsel på forbruger-GPU er langsom, så APOB AI tilbyder gratis hosting. [briefingen 4. august](/archive/2026-08-04)