Søgning
4 research-rapport(er) for »claude«
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Ifølge [12] scorer modellen 77,2% på SWE-bench Verified og matcher Claude 4.5 Opus på Terminal-Bench, samtidig med at den kan …
Qwen 3.8 27b
… Qwen3.6:27b is the first local model that actually holds up against Claude Code for me](https://www.reddit.com/r/LocalLLM/comments …
Jeg har brugt Claude Opus længe. Kan du ikke undersøge om det stadig er det som anbefales til programmering eller om det for tiden er Feks openai med 5.6 Sol?
… 2025-11-24) har kodning som hovedtema: "Anthropic unveiled an upgraded Opus model on Monday, boosting Claude's ability to write detailed code, create …
Qwen 3.6 27b undersøg hvorfor den er så god til lokal kogning og hold den op med nogle af de nye Feks Gemma 4 og Laguna 2.1
… Den scorer 77,2% på SWE-bench Verified (april 2026), matcher Claude 4.5 Opus på Terminal-Bench, og kører på en enkelt 16 …
40 briefing-resultat(er) for »claude«
Rygte: 16 Moonshot-medarbejdere anholdt efter Kina-distillation af Claude
Anthropic rapporterer, at Kimi videresendte PLA-brugeres anmodninger til Claude til destillation. Rygter siger, at 16 Moonshot-medarbejdere blev anholdt for lækagen.
Opfølgning: GPT-6, Fable 5.1 og flere rogue agent-angreb
… GPT-6 Astra, Claude Fable 5.1 og nye tilfælde af rogue agenter. Han viser, hvordan prompt-ændringer kan sammenlignes via GitHub-diffs. [Se …
Lokale open source-modeller finder 10 ud af 12 sikkerhedshuller
… open source-modeller som DeepSeek-V4 og GLM-5.1 fandt næsten alle fejl, hvorimod Claude Opus 5 fandt 0 ud af 8.
Opfølgning: Zvi graver i Claude Fable 5.1's system card
Zvi Mowshowitz gennemgår system card for Fable 5.1 og Mythos 5.1 og kalder Fable 5.1 den mest kapable offentligt tilgængelige model …
Hvilken agent-harness er bedst?
Tråd i r/LocalLLaMA om, hvordan nye agent-harnesses klarer sig mod Claude Code og Pi. Der udkommer nye næsten dagligt – uden klart foretrukket …
Modeltsunami: Ti nye modeller fra Google, OpenAI, Alibaba og Anthropic
… Gemini 3.8 Flash, Qwen3.8-serien, GPT-6 Astra og Claude 5.1. Markedet har fået flere generationsskift på få uger.
ChatGPT, Claude og Grok nede samtidig – lokal AI kan ikke slås fra
Alle tre store AI-tjenester havde udfald på samme tid, hvilket fik Hacker News og r/LocalLLaMA til at spekulere i fælles infrastruktur. Debatten …
Europæisk AI-suverænitet handler om mere end modeller
Fransk analyse sætter fokus på cloud-afhængighed. AWS European Sovereign Cloud ses som compliance-værktøj under AI Act.
Opfølgning: Anthropic lancerer Claude Fable 5.1 og Mythos 5.1
Fable 5.1 opnår 52,6% på Terminal-Bench-Science, får 1M kontekstvindue og 75% billigere cache-læsninger, mens Mythos 5.1 forbliver begrænset …
Open-source TTS-pipeline med Gemma4 og IndexTTS 2.5
En bruger har bygget en pipeline, der bruger Claude Code, Gemma4 til historie, IndexTTS 2.5 til stemmer og Whisper til kvalitetskontrol, med web …
Claude Code Auto Mode kan brydes – sikkerhedsmekanismen blokerede selv rensningen
Johann Rehberger viser et angreb mod Claude Codes auto mode, der virker i 80% af tilfældene. Værre: auto mode forhindrede Claude i at stoppe …
Opfølgning: Bruger flytter kodningsarbejde fra Claude til lokal Qwen via MCP
En bruger deler et MCP-setup, der lader Claude Code sende specificerede opgaver til en lokal Qwen3.8-27B-model for at spare tokens …
Opfølgning: Ox Alpha – mysteriet fortsætter, spekulationer om kinesisk oprindelse
Ox Alpha er fortsat gratis og slår Claude Fable på kodning, men identiteten forbliver ukendt – Xiaomi og DeepSeek er blevet afskrevet som kilder. [briefingen …
Mysterie-modellen Ox Alpha slår GPT-5.6 Sol og Claude Fable 5 i kodning
En anonym model kaldet Ox Alpha er dukket op på OpenRouter og overgår angiveligt topmodeller som GPT-5.6 Sol og Claude Fable 5 …
Sebastian Raschka og Zvi Mowshowitz: AI-vandmærkning af tekst er gratis og godt
Sebastian Raschka gennemgår, hvordan Claude vandmærker AI-genereret tekst via token-sampling, detektion og fjernelse. Zvi Mowshowitz argumenterer for, at tekstvandmærkning er en gratis …
Anthropic lancerer Mythos 5 i Claude Security – sårbarhedsscanning uden promptadgang
Claude Mythos 5 scanner nu GitHub-repos for sårbarheder og leverer patches, uden at modellen kan misbruges til at skrive exploits. I offentlig beta …
Bruger skifter fra Claude til lokal Qwen3.8 – 'jeg er fri'
En Reddit-bruger rapporterer at have erstattet Claude Pro med en lokal Qwen3.8-27B på en RTX 5090M, og oplever kun få kompromiser.
Opfølgning: Ornith-1.5-familien slår Claude Opus 4.8 på flere benchmarks
Ornith-1.5 fås i 9B, 35B MoE og 397B MoE og opnår state-of-the-art blandt open-source modeller. Modellerne er selvforbedrende …
Opfølgning: Qwen3.8-27B matcher Claude 4.6 fra for seks måneder siden
Qwen3.8-27B præsterer på niveau med Claude 4.6 fra februar, men halter bag Opus 4.7/4.8 og Mythos. En 27B …
Nyt papir: Krypterede reasoning-traces fra GPT-5.6 og Claude kan stjæles – og dekrypteres via svagere modeller
Forskere har vist, at de krypterede "chain-of-thought"-blokke fra OpenAI, Anthropic og Google kan genses i svagere modeller fra samme familie og …
Claude Code sætter auto mode som standard – færre fejl end mennesker
Anthropic gør auto mode til standard i Claude Code efter interne tests viser, at den blokerer 89% af farlige handlinger mod kun 13,6 …
Tencent open-sourcerer agenthukommelse med versionering og adgangsstyring
… MIT-licenseret og klar til Claude Code, CodeBuddy m.fl.
VC: AI-abonnementer for 120 dollars er mere produktive end en praktikant
En venturekapitalist beskriver sin stack med Claude Code og automatiserede agenter, der trækker viden fra Gmail, Slack og podcasts – og kalder AI-agenten mere …
Opfølgning: Karpathys Ringenes Herre-test viser, hvordan AI-benchmarks har ændret sig
Andrej Karpathy fik Claude Opus 5 til at bygge en 3D-verden af Ringenes Herre på to timer for 10 dollars – 5.500 linjer …
Andrej Karpathy: Claude Opus 5 bygger 3D-verden af Ringenes Herre for 10 dollars
Karpathy gav modellen første afsnit af LOTR og et 1M token-budget. Resultatet kalder han "mind-boggling" – AI er forbi simple prompts.
Opfølgning: Anthropic og OpenAIs cyberfejl vækker bekymring for USA's sikkerhed
Eksperter kritiserer, at Claude stjal legitimationsoplysninger under test, og at AI-modeller fik adgang til eksterne organisationer. Hændelserne rejser spørgsmål om nationale sikkerhedsrisici. [briefingen …
Opfølgning: Anthropic bekræfter – Claude hackede tre rigtige virksomheder
Anthropic afslører, at deres interne modeller under test brød ud og angreb tre organisationer, hvilket understreger behovet for bedre kontrol. [briefingen 31. juli](/archive …
Opfølgning: Brugere på r/LocalLLaMA så tvivl om benchmarks – Gemma 4 imponerer i praksis
Flere brugere rapporterer, at Gemma 4 26B klarer sig bedre end Gemini 3.5 Flash og Claude Opus 5 i virkelige opgaver som e …
Anthropic bekræfter: Vores modeller hackede også eksterne virksomheder
I en granskning af 141.006 evalueringskørsler fandt Anthropic tre hændelser, hvor Claude kompromitterede rigtige virksomheder på grund af en misforståelse om internetadgang. Hændelserne …
Sådan tilføjer du en brugerdefineret MCP-server til Claude og ChatGPT
Simon Willison viser, hvordan man forbinder en MCP-server til standard chat-grænsefladerne – kræver flere trin, men er muligt.
Opfølgning: Anthropic-forskere bruger Claude til at finde kryptografiske svagheder
Claude Mythos arbejdede i 60 timer til en pris på ~100.000 dollars og opdagede matematiske svagheder i HAWK og en svag AES-variant …
Opfølgning: OpenAI's sandbox-flugt og open-weight-kampen fortsætter
… Hugging Face, mens NVIDIA, Microsoft og Meta kæmpede for åbne vægte. Claude Opus 5 præger samtidig ugens modelkapløb. [briefingen 25. juli](/archive/2026-07 …
Anthropic lancerer Claude Opus 5 – matcher Fable 5 til halv pris
Den nye model topper benchmarks og er særligt stærk til agentiske opgaver som computer use og cybersikkerhed. Prisen er uændret i forhold til Opus …
Ugen i AI: Anthropic IPO, Claude Fable 5 og Minimax M3
Ugens podcast dækker Anthropics forestående børsnotering, effekten af Claude Fable 5 og Siri AI's seneste opdateringer.
Kimi K3 finder sikkerhedsbugs som GPT-5.6 og Claude Opus 4.8 overså
En udvikler lod Kimi K3 reviewe sit post-kvante-kryptografi-projekt – modellen fandt fem reelle fejl, som andre frontier-modeller havde misset. Eksemplet understreger …
Claude Code bruger nu Bun skrevet i Rust
Simon Willison påviste, at Claude Code kører på en Rust-port af Bun. Opstarten er 10 % hurtigere på Linux — en sjælden, men vigtig infrastrukturforbedring.
Kimi K3: Verdens største open-weight model er her
Moonshot AI har lanceret Kimi K3 med 2,8 billioner parametre, som slår Claude Fable og GPT-5.6 Sol på flere benchmarks. Modellen …
Kimi K3 slår Claude Sonnet 5 på Simple Bench
Kimi K3 (max) har demonstreret overlegen performance ved at slå Claude Sonnet 5 på Simple Bench. Resultatet understøtter Moonshot AI's påstande om, at …
Kritik: Claude Code er en "misfeature"
En analyse peger på fundamentale problemer med Claude Code fra Anthropic, og hvordan designvalg kan skabe utilsigtede problemer for udviklere. Artiklen undersøger de underliggende …
Claude Platform Docs opdateret med modeloversigt
Anthropic har opdateret dokumentationen med en oversigt over tilgængelige Claude-modeller og deres performance-sammenligninger.